全部AI 动态
全部动态
今日 3 条
Ethan Mollick@emollickAI 评分7575The Decoder:AI News(RSS)AI 评分7373 数学家 Buckmaster 称 OpenAI 施压并要求将 Anthropic 职位合作者移出 Navier-Stokes 论文
数学家 Tristan Buckmaster 公开发声,称 OpenAI 在其与 Levent Alpöge 借助 Claude 和 Codex 运行 GPT-5.6 Sol 在 Navier-Stokes 方程上取得进展后对其施压。
Boris Cherny@bchernyAI 评分6060
The Decoder:AI News(RSS)AI 评分6666 ASML 锁定 TSMC、三星、Intel 采用 High-NA EUV,华为推动中国 DUV 去依赖
据 Bloomberg 报道,三星计划 2028 年起将 ASML High-NA EUV 用于量产,TSMC 计划 2030 年,Intel 已在运行,单台机器成本高达 4 亿美元;四家公司还计划将光掩膜从六英寸转向十二英寸,ASML 技术负责人称可提升 High-NA 产能 40%,TSMC 与 ASML 计划 2031 年建测试线、2033 年投产。
X.PIN@thexpinAI 评分5555科技记者撰文回应 Bill Gates 在 Gates Notes 发表的约 6000 字 AI 长文,认为其诊断过于着眼未来,缺少对推动当前热潮的创始人、投资者、银行和云厂商的问责机制。
Nathan Lambert:Interconnects(RSS)AI 评分5151 开源动态第 24 期:Motif-3、GLM-5.3、Hy4-preview 与开源模型许可证趋势
本期开源模型汇总指出,2026 年开源模型竞争加剧带来许可证分化:Google 和 Meta 转向 Apache 2.0,而智谱 GLM-5.3 从 MIT 改为自定义许可证,要求年收入超 100 亿美元的推理或微调服务商通过 Z.AI 安全审查,且未定义关联方带来不确定性。
SemiAnalysis@SemiAnalysis_AI 评分5757IT之家(RSS)AI 评分7373 OECD 报告:少用 AI 完成课业的学生整体表现优于常用 AI 的学生
OECD 最新教育报告显示,不用或少用 AI 完成课业的学生整体表现优于经常使用 AI 的学生,样本覆盖 91 个国家超过 76 万名学生。从不使用 AI 起草写作作业的学生科学平均分为 509 分,每天使用者仅 481 分,差距约相当于一年半教学量;报告强调结果取决于使用方式,每周使用一两次且以学习为目的的学生成绩反而最高,课堂上常被要求评估 AI 生成信息的每天使用者成绩高出 13 分。
凡人小北@frxiaobeiAI 评分7272IT之家(RSS)AI 评分5858 Similarweb:8 月 ChatGPT 网页端 AI 聊天流量份额回升至 55.5%,同比优势收窄
Similarweb 公布 2026 年 8 月 AI 聊天机器人网页端流量统计,ChatGPT 份额从 3 个月前的 52.7% 回升至 55.5%,但较去年同期的 73.3% 大幅下降。
IT之家(RSS)AI 评分6363 美国执法机构担忧雷朋 Meta 智能眼镜被用于秘密监控与恐袭侦察
据《卫报》获得的十几份文件显示,美国纽约市警察局、国土安全部融合中心及 ICE 等执法机构发布备忘录,警告雷朋 Meta 智能眼镜可能被用于在警察和拘留设施内秘密拍摄、泄露安保流程,甚至协助恐袭前的目标侦察。
-Zho-@ZHO_ZHO_ZHOAI 评分5353IT之家(RSS)AI 评分6363 微软提出让每张办公桌每个家庭拥有不受限制的智能的新愿景
微软 Windows 与设备销售企业副总裁 Mark Linton 在 IFA 2026 上提出新愿景,让每张办公桌、每个家庭都拥有不受限制的智能,即本地运行日常 AI 模型、云端只留给复杂任务。
Hacker News 热门(buzzing.cc 中文翻译)精选AI 评分8383 数学家巴克马斯特宣布多项方程 blowup 结果并公开与 OpenAI 沟通经过
特里斯坦·巴克马斯特(Tristan Buckmaster)与 Levent Alpöge 公开三项有限时间 blowup 结果,涵盖带光滑强迫的不可压缩多孔介质方程。
推荐理由:作者亲历描述用 LLM 完成偏微分方程 blowup 证明的过程,并公开与 OpenAI 沟通的时间线,为评估 AI 参与前沿数学研究提供了第一手材料。
Thomas Wolf@Thom_WolfAI 评分5252
Dan Hendrycks@hendrycksAI 评分4545公众号:卡尔的AI沃茨AI 评分5454 实测个人AI助手Today:记忆可改可删,晨间简报按日程偏好自动调整
作者以自己的日历、跑步训练和睡眠数据实测个人生活AI助手Today(Public Beta),认为其定位是个人生活连续性管理而非任务交付型工作Agent。文中记录了三个体验:日程被临时打乱时生成晨间简报并建议同步日历、睡眠不足时自动顺延非紧急待办、记忆面板可查看编辑删除每条事实且改动即时生效。作者建议按阶梯信任逐步开放权限,并指出语言切换不同步等早期产品问题。
vLLM 官方博客(RSS)精选AI 评分6363 vLLM x AgentX:面向真实世界智能体推理服务的全栈优化
vLLM 团队发布针对智能体负载优化的博客,基于 SemiAnalysis 的公开 AgentX 基准展示成果:DeepSeek V4 Pro 在 GB300 上达到 83K total tokens/GPU-秒。
推荐理由:vLLM 团队结合 AgentX 实测数据讲解智能体负载的全栈优化方法与失败教训,读者可以借此理解并行策略如何跟随模型架构调整。
Simon Willison 博客AI 评分6161 kernel.org 运维者谈滥用爬虫:14 个 CPU 核心专为爬虫渲染 git 提交页面
Simon Willison 转述 Konstantin Ryabitsev 的观察:git.kernel.org 为应付滥用爬虫的“背景辐射”,在 5 个地理分布节点上常年有 14 个 CPU 核心专门把 git 提交渲染成 HTML,CPU 开销超过包括 git clone 在内的所有合法访问。Willison 担忧这对提供大量可爬网页的 Datasette 也有影响。
Rohan Paul@rohanpaul_aiAI 评分5252
SemiAnalysis@SemiAnalysis_AI 评分5959The Decoder:AI News(RSS)AI 评分6060 GPT-6 Astra 在无人工干预下约 23 小时 43 分钟通关 Portal
开发者 cozyblaze 在 X 上宣布,GPT-6 Astra 在设定初始目标后无需任何人工帮助通关了完整 Portal,用时约 23 小时 43 分钟,按 Astra 牌价 token 花费至少 570 美元,实际使用 200 美元的 Codex 订阅。
The Decoder:AI News(RSS)AI 评分5353 Similarweb 数据显示 ChatGPT 网站流量份额回升至 55.5%,Gemini 回暖势头消退
Similarweb 数据显示,ChatGPT 网站 AI 聊天流量份额从三个月前的 52.7% 回升至 55.5%,Gemini 则从 27.8% 降到 25.6%。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分5959 湖南大学论文借 OpenAI Codex 证明球面 Hadwiger 猜想引发数学界前景讨论
博主 _alternator_ 撰文讨论湖南大学 Wang & Wu 的新预印本,其证明自 1974 年悬置的球面 Hadwiger 猜想时声明使用了 OpenAI Codex 协助完善证明细节、查找缺口和排版编辑。
Ars Technica:AI(RSS)AI 评分6161 Ar Technica 起底 32 亿美元 AI 数据中心背后的复杂企业网络与问责难题
纽约 Somerset 的 Lake Mariner 数据中心(32 亿美元,前煤矿地块)6 月初发生火灾,消防员进入时无可用警报、无灭火系统、三个消火栓失效,本应可供查看的安全文件据称已随大火烧毁。
jason@jxnlcoAI 评分5757The Decoder:AI News(RSS)AI 评分7676 OpenAI 发布自动化研究内部数据,Pachocki 撰文警告无实验室已解决对齐与监控
OpenAI 发布博客文章称已达成去年秋天设定的「自动化研究实习生」目标,计划 2028 年 3 月前建成全自动 AI 研究员;数据显示截至 8 月中旬研究部门每 1 个人类工作日运行 3.1 个智能体工作日,中位研究员每天推理花费超 600 美元,90 分位超 7000 美元,token 产出自 2025 年 12 月以来增长 124 倍。
The Decoder:AI News(RSS)AI 评分6464 ChatGPT 冲击内罗毕论文代写行业,鼎盛期从业者曾达数万人
纽约时报报道,肯尼亚曾有为美英学生代写学术论文的行业,内罗毕鼎盛期至少有 40,000 人从业。从业者 Teresios Bundi 十二年写过 2,500 多篇论文,后期每篇收费 40 至 70 美元;ChatGPT 于 2022 年发布后,价格和订单崩塌,剩下的是改写 AI 文本以通过查重的'人味师',牛津教授 Mark Graham 预计类似冲击将在全球出现。
IT之家(RSS)AI 评分6969 OpenAI 披露研究员 AI 编程智能体用量,前 10% 用户日耗 Token 价值超 7000 美元
OpenAI 发布博客首次披露研究人员使用 AI 编程智能体的规模和成本。截至 8 月中旬,普通研究员日耗 Token 价值中位数超 600 美元(7 月为 162 美元),前 10% 用户超 7000 美元,数字按 API 公开推理价格估算,非实际支出。
凡人小北@frxiaobeiAI 评分6363Ars Technica:AI(RSS)AI 评分5757 Ars Technica 起底 32 亿美元 AI 数据中心背后的复杂企业网络
纽约 Somerset 的 Lake Mariner 数据中心一栋未完工建筑 6 月初起火,Barker 消防队长 Steve Matisz 称消防员近乎盲入,现场无可用报警器、灭火系统,三个消火栓失效,应依法可查的安全文件据称也在火中烧毁。
IT之家(RSS)AI 评分6767 OpenAI 首席科学家 Jakub Pachocki 发文呼吁放慢 AI 发展速度,警告智能体可能失控
OpenAI 首席科学家 Jakub Pachocki 发表长篇博文,担心没有人准备好应对机器智能持续快速增长的后果,呼吁建立可由第三方审计、政府或国际组织执行的强制性安全门槛。
IT之家(RSS)AI 评分5353 Arena 第 36 周 AI 大模型盲测榜:国产多模型扎堆入榜前端开发榜,阿里 wan3.0 冲进视频榜前三
Arena(arena.ai)平台发布 2026 年第 36 周(8 月 31 日~9 月 6 日)AI 大模型盲测排名。
Hacker News 热门(buzzing.cc 中文翻译)AI 评分5555 Hacker News 讨论:用 Fable 逆向 PianoDisc 钢琴格式后能否公开编解码器
用户 jmpman 用 Astra 和 Fable 两个 AI 模型互相协作,逆向了 PianoDisc Protigy 自动钢琴的 mp3 MIDI 编码格式,发现其右声道以 2004.5 Hz 方波承载 MIDI,并内置 decoy notes 混淆以阻止提取的 MIDI 在其他系统播放。
IT之家(RSS)AI 评分5959 黄仁勋祝贺 OpenAI 发布 Astra 并称 AGI 已到来,Gary Marcus 认为为时过早
黄仁勋 9 月 7 日在 X 祝贺 OpenAI 发布新模型 Astra,称从 ChatGPT 到 o1 再到 Astra 只用 4 年,AGI 已经到来;OpenAI 称 Astra 是全球最智能、最符合人类价值观的模型,总裁布罗克曼表示欢迎来到 AGI 时代。
Simon Willison 博客AI 评分5353 Simon Willison 评 OpenAI 内部研究加速与编码智能体使用激增
Simon Willison 评论 OpenAI 关于 Recursive Self-Improvement(RSI)的新文章及首席科学家 Jakub Pachocki 的 essay《An Alien Mind》。
公众号:数字生命卡兹克精选AI 评分7272 GPT-6 Astra爆火后,卡兹克谈执行能力贬值与判断力断层
GPT-6 Astra上线后,大量用户用它自主操控Blender、Houdini、Unity、Aseprite等专业软件,做出游戏Demo、3D复刻旧金山艺术宫等作品,其中旧金山艺术宫案例里Astra自己搜索几百张参考图、翻到美国国会图书馆的老扫描文件找柱子尺寸,多数工作在夜间自主完成。
推荐理由:作者从大量GPT-6 Astra操控专业软件的案例出发,讨论执行能力贬值与判断力从何而来的矛盾,视角具体。
Charlie O’Neill 研究写作(RSS)AI 评分6060 Charlie O'Neill 谈 RL 环境信仰与理性下注:长、真、自有
Charlie O'Neill 撰文指出,宣称一切将是 RL 环境的人很少按该信念做出理性行动,如同当年 scaling 和 AGI 信奉者并不真下注。他提出无论 RSI 是否成立都应造高价值数据与环境:若 RSI 成立,单位效用环境价值将指数增长,值得在实验室内做最有针对性、可累积的环境;若不成立,实验室需要模型在所有领域变强,会为有用数据支付高价。
Tomer Tunguz 博客(VC 分析)精选AI 评分6565 Tomer Tunguz 解析 AI 消耗的三波浪潮:从聊天到智能体再到 meta-harness
VC Tomer Tunguz 提出 AI token 消耗分三波:聊天约 1m tokens/人/天,单智能体约 100m–200m tokens/天,meta-harness 并行调度多智能体可达数十亿。
推荐理由:作者提出 AI 消耗分三波叠加增长的框架,并用 OpenRouter 与企业数据解释为何线性外推算力需求会失真。
Gary Marcus:The Road to AI We Can Trust(RSS)AI 评分5656 Gary Marcus 质疑 Jensen Huang 无定义无证据地宣称 AGI 到来
Gary Marcus 撰文批评 Jensen Huang 宣称 AGI 竞赛已结束,指出其未给出证据和定义,并建议其参考 Hendrycks、Yoshua Bengio 等人参与的 agidefinition.AI。