#现象/趋势
#现象/趋势
今日 3 条
Rohan Paul@rohanpaul_aiAI 评分5252
SemiAnalysis@SemiAnalysis_AI 评分5959The Decoder:AI News(RSS)AI 评分6060 GPT-6 Astra 在无人工干预下约 23 小时 43 分钟通关 Portal
开发者 cozyblaze 在 X 上宣布,GPT-6 Astra 在设定初始目标后无需任何人工帮助通关了完整 Portal,用时约 23 小时 43 分钟,按 Astra 牌价 token 花费至少 570 美元,实际使用 200 美元的 Codex 订阅。
The Decoder:AI News(RSS)AI 评分5353 Similarweb 数据显示 ChatGPT 网站流量份额回升至 55.5%,Gemini 回暖势头消退
Similarweb 数据显示,ChatGPT 网站 AI 聊天流量份额从三个月前的 52.7% 回升至 55.5%,Gemini 则从 27.8% 降到 25.6%。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分5959 湖南大学论文借 OpenAI Codex 证明球面 Hadwiger 猜想引发数学界前景讨论
博主 _alternator_ 撰文讨论湖南大学 Wang & Wu 的新预印本,其证明自 1974 年悬置的球面 Hadwiger 猜想时声明使用了 OpenAI Codex 协助完善证明细节、查找缺口和排版编辑。
Ars Technica:AI(RSS)AI 评分6161 Ar Technica 起底 32 亿美元 AI 数据中心背后的复杂企业网络与问责难题
纽约 Somerset 的 Lake Mariner 数据中心(32 亿美元,前煤矿地块)6 月初发生火灾,消防员进入时无可用警报、无灭火系统、三个消火栓失效,本应可供查看的安全文件据称已随大火烧毁。
IT之家(RSS)AI 评分5656 GPT-6 Astra 自主通关《传送门》:耗时约 24 小时,3336 次工具调用
一名 AI 爱好者 CozyBlaze 让 OpenAI 新旗舰模型 GPT-6 Astra 自主通关了 Valve 的 3D 解谜游戏《传送门》,全程约 24 小时,共进行 3336 次工具调用,按 API 价格计算约 571.18 美元,但实际成本由其每月 200 美元的 Codex Pro 订阅覆盖。
The Decoder:AI News(RSS)AI 评分6464 ChatGPT 冲击内罗毕论文代写行业,鼎盛期从业者曾达数万人
纽约时报报道,肯尼亚曾有为美英学生代写学术论文的行业,内罗毕鼎盛期至少有 40,000 人从业。从业者 Teresios Bundi 十二年写过 2,500 多篇论文,后期每篇收费 40 至 70 美元;ChatGPT 于 2022 年发布后,价格和订单崩塌,剩下的是改写 AI 文本以通过查重的'人味师',牛津教授 Mark Graham 预计类似冲击将在全球出现。
IT之家(RSS)AI 评分6969 OpenAI 披露研究员 AI 编程智能体用量,前 10% 用户日耗 Token 价值超 7000 美元
OpenAI 发布博客首次披露研究人员使用 AI 编程智能体的规模和成本。截至 8 月中旬,普通研究员日耗 Token 价值中位数超 600 美元(7 月为 162 美元),前 10% 用户超 7000 美元,数字按 API 公开推理价格估算,非实际支出。
Ars Technica:AI(RSS)AI 评分5757 Ars Technica 起底 32 亿美元 AI 数据中心背后的复杂企业网络
纽约 Somerset 的 Lake Mariner 数据中心一栋未完工建筑 6 月初起火,Barker 消防队长 Steve Matisz 称消防员近乎盲入,现场无可用报警器、灭火系统,三个消火栓失效,应依法可查的安全文件据称也在火中烧毁。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分5555 Hacker News 讨论:用 Fable 逆向 PianoDisc 钢琴格式后能否公开编解码器
用户 jmpman 用 Astra 和 Fable 两个 AI 模型互相协作,逆向了 PianoDisc Protigy 自动钢琴的 mp3 MIDI 编码格式,发现其右声道以 2004.5 Hz 方波承载 MIDI,并内置 decoy notes 混淆以阻止提取的 MIDI 在其他系统播放。
Tomer Tunguz 博客(VC 分析)精选AI 评分6565 Tomer Tunguz 解析 AI 消耗的三波浪潮:从聊天到智能体再到 meta-harness
VC Tomer Tunguz 提出 AI token 消耗分三波:聊天约 1m tokens/人/天,单智能体约 100m–200m tokens/天,meta-harness 并行调度多智能体可达数十亿。
推荐理由:作者提出 AI 消耗分三波叠加增长的框架,并用 OpenRouter 与企业数据解释为何线性外推算力需求会失真。
Rohan Paul@rohanpaul_aiAI 评分6060
Dan Hendrycks@hendrycks精选AI 评分7878推荐理由:Hendrycks 是 AI 安全领域权威,此观点结合 OpenAI、Anthropic 等最新实证案例,揭示了 Agent 行为中潜在的“亲缘利己”风险,对理解 AI 对齐与安全治理具有重要参考价值。
Rohan Paul@rohanpaul_aiAI 评分8282
Rohan Paul@rohanpaul_aiAI 评分6060
Yuchen Jin@Yuchenj_UWAI 评分5151
OpenAI:官网动态(RSS · 排除企业/客户案例)精选AI 评分8282 OpenAI 发布内部研究加速报告:已达成自动化研究实习生目标,推进 2028 年 3 月自动化 AI 研究员
OpenAI 发文披露自动化研究进展,宣布已达成去年秋天设定的今年 9 月拥有自动化研究实习生(可在人类指导下完成耗时数天的明确研究任务)的目标,并计划在 2028 年 3 月前造出自动化 AI 研究员。
推荐理由:OpenAI 以内部数据披露 coding agent 对研究工作的实际影响和 RSI 进展,读者可以据此了解前沿实验室的自动化研究现状。
IT之家(RSS)AI 评分5757 卫报报道 AI 生成食物图片攻占美国餐厅菜单引发消费者反感
卫报报道称,越来越多美国餐厅在菜单和营销材料中使用 AI 生成的食物图片,消费者普遍觉得诡异、倒胃口,旧金山 Grind & Unwind 因 AI 招牌遭涂鸦后花费约 700 美元重新粉刷墙面。美国餐饮协会 2026 年报告显示 26% 的餐厅经营者已在使用 AI,牛津大学研究则发现一旦得知图片由 AI 生成,食客对其吸引力评价明显下降。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分7070 Ben Evans 长文分析:AI、工具与企业转型为什么没那么简单
Ben Evans 撰文分析 AI 为何难以像硅谷期待的那样直接扫清企业软件的重复任务。他指出多数人不是工具建造者,发现该自动化什么、以及如何重新定义问题才是难点;企业软件长期处于制度化与自发的光谱上,AI 只是制造新选择、移动阈值,而不改变问题本身。
IT之家(RSS)AI 评分6363 CNBC:科技巨头一周密集更新 AI 模型,模型疲劳问题凸显
据 CNBC 报道,一周内 Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1,Meta 推出 Muse Spark 1.3。
IT之家(RSS)AI 评分6464 微软提出无计量智能战略,推动 AI 在 Windows PC 本地运行
据 Windows Latest 报道,微软在 IFA 2026 上由 Windows 与设备部门企业副总裁 Mark Linton 提出 unmetered intelligence(无计量智能)概念,希望把原本依赖云端 OpenAI、Claude 等服务的日常 AI 工作转移到用户 PC 本地运行,改变 token 的经济模式,同时云端 AI 仍是体系的重要部分。
IT之家(RSS)AI 评分5959 AI 短剧制作价格大跳水,每分钟报价从 5000 元跌至几百元
据央视财经报道,AI 短剧技术门槛下降、从业者涌入,制作报价从每分钟 5000 元跌至几百元,逼近成本线,但定制短剧仍可达每分钟 1 万至 2 万元。行业竞争正从拼产量、拼价格转向拼内容、拼市场,预计 2026 年国内 AI 剧漫剧市场规模有望超 400 亿元,同比增速 138%,海外规模预计突破 40 亿美元,占海外微短剧整体规模近 70%。
IT之家(RSS)精选AI 评分7777 Fortune 报道 OpenAI 多次修改 GPT-6 Astra 基准测试数据,部分成绩大幅变化
据 Fortune 报道,OpenAI 自 9 月 3 日发布 GPT-6 Astra 公告以来多次修改评测基准数据:Astra 幻觉率曾从 4.2% 降至 2% 后又改回。
推荐理由:原文基于网页快照逐项梳理数据变动细节,并给出多方的不同解读,可用于理解基准测试成绩为何容易波动和引发质疑。
ginobefun@hongming731AI 评分5555BestBlogs 早报 09-06 精讲三篇工程实践:蚂蚁数科魏长征在 AICon 分享 Harness 验收闭环,覆盖 40 万行 Rust 新项目与 60 万行 C++ 存量项目。
TechCrunch:AI(RSS)AI 评分5353 三名徒步者依赖 Google Gemini 规划登山后被困 Mount Shasta 获救
三名徒步者用 Google Gemini 规划行程后在加州 Mount Shasta 被救,Siskiyou 县警长办公室称 Gemini 建议他们携带的食物和水远低于所需。三人凌晨3点出发,晚上7点才登顶,夜间下山迷路后在 Mud Creek Canyon 过夜,次日由 Forest Service 护林员和志愿者救出,警方提醒不要完全依赖 AI 做行程规划。
-Zho-@ZHO_ZHO_ZHOAI 评分5151ZHO 实测 GPT-6 Astra(ChatGPT Work,Ultra 档),输入一张建筑照片和一条地狱难度提示词,让模型基于传统工作流重建建筑。
IT之家(RSS)AI 评分5959 研究称得克萨斯州大学毕业生失业率在 AI 快速发展期间升至异常高水平
《金融时报》9 月 2 日报道,达拉斯联邦储备银行研究发现,自 ChatGPT 发布以来,得克萨斯州受 AI 影响较高行业的招聘职位大幅减少,2025 年第一季度这类职位招聘减少约 8%,大学毕业生失业率升至异常高水平。
Rohan Paul@rohanpaul_aiAI 评分2525
DogeDesigner@cb_dogeAI 评分99DogeDesigner 发推分享一张原始人钻木取火的图片,配文“没有 Grok Bot 的生活”,以玩梗方式调侃没有 Grok Bot 的状态。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分4545 为什么下一个令牌预测器是对 LLM 的错误思维模型
作者认为下一个令牌预测器只是对 LLM 的零阶近似,机制形态正确但不完整。现代后训练中的 RLVR 让模型通过自己探索生成的新序列并获得奖励来学习,类似会穷尽探索的象棋引擎而非模仿大师棋谱的下一步预测器,因此 RLHF 和 RLVR 编码的内容早已超出对现有文本的预测。
X.PIN@thexpinAI 评分5959文章分析内蒙古乌兰察布为何成为中国增长最快的 AI 算力集群之一,核心论点是中国把电力而非芯片视为 AI 竞赛的关键约束,将发电作为数据中心本身的一部分来建设。
Ethan Mollick@emollickAI 评分1919Ethan Mollick 引用网友关于 zork 转 3D、Fortnite 转文本的玩笑帖,称已有人把 Space Invaders 做成电子表格,由 Astra 用 VBA 实现,并附上视频。
lauren@potetoAI 评分2525
-Zho-@ZHO_ZHO_ZHOAI 评分2424IT之家(RSS)AI 评分6161 美国加州 3 名登山者轻信 Gemini 路线建议被困沙斯塔山,报警获救
据 TechRadar 报道,美国加州 3 名缺乏经验的登山者向 Gemini 咨询沙斯塔山路线,按其预计 8 小时登顶的建议出发,实际耗时约 16 小时才登顶。他们夜间下撤时偏离路线进入 Mud Creek Canyon,一人膝盖受伤,报警后次日早晨获救,事后承认过于依赖 AI 而未自行判断。
jason@jxnlcoAI 评分1313
-Zho-@ZHO_ZHO_ZHOAI 评分2020
Ethan Mollick@emollickAI 评分4242
elvis@omarsar0AI 评分2020