Anthropic 提出 3 步 Pace the Frontier 放缓计划,获 OpenAI、xAI 和 Microsoft 声援
2026 年 9 月 12 日 Anthropic CEO Dario Amodei 发文《We Must Pace the Frontier》,提出嵌入评估员、民主协调和全球协调 3 步计划,并单方面承诺向第三方评估员提供常驻员工级权限。
2026 年 9 月 12 日 Anthropic CEO Dario Amodei 发文《We Must Pace the Frontier》,提出嵌入评估员、民主协调和全球协调 3 步计划,并单方面承诺向第三方评估员提供常驻员工级权限。
Bryan Cantrill 忏悔大学时期在机房谎报病毒引发恐慌的旧事,以此类比当前AI灭绝风险言论。他批评前 Anthropic 员工 Jacob Coxon 与 Anthropic 对齐科学负责人 Evan Hubinger 认同的"AI 在十年内杀死全人类概率 >10%"的表态,指出这类主张缺乏证据、依赖模糊外推,并强调工程离不开物理世界与人类问责,专家不应滥用公众信任。
自媒体作者专访AI影像创作者DiDi_OK,聊其用Seedance 2.5制作的新片《糖果》及此前B站播放2000万的《牌子》。DiDi_OK认为Seedance 2.5在运动规律和高度定制化上跨时代升级,让他做出几乎百分百纯AI的片子,省掉约60%叙事成本,参考图重要性下降、提示词作用上升;他还谈到AI时代创作本质在于取舍判断,模型变强后自己反而更痛苦,表达成本越低,平庸越没有借口。
Trump 和众议院议长 Mike Johnson 认为 AI 高管们反应过度,担心暂停发展会让中国在 AI 竞赛中反超。此前 Dario Amodei 发表公开信呼吁放缓前沿 AI 发展,Sam Altman、Elon Musk 和 Demis Hassabis 表示支持。据 Financial Times 报道,Trump 称美国正领先中国,谁赢得 AI 就赢得一切。
TechCrunch Equity 播客讨论 AI 行业关于生存威胁的最新争论。起因是研究员 Jacob Coxon 因担忧头部 AI 公司在拿人类生命冒险而辞去 Anthropic 职务,Anthropic 对齐负责人随后发帖称真诚认为 AI 可能杀死全人类,并给出未来十年内概率大于 10% 的个人判断。
David Sacks 回应 Dario 与 Sam 的“放缓前沿”主张,表示支持两家自行减速,因为其已构成前沿智能双寡头。他反对以反垄断豁免、监管审批流程为条件,并称 METR 与 Anthropic 的投资人和员工关系密切并不独立;他认为市场本身已惩罚不可预测的模型行为,放缓的真实动机包含规避网络攻击产品责任风险,而非纯粹利他。
Gary Marcus 评析 Dario Amodei 倡导放慢 AI 发展并支持透明度的文章,Sam Altman 与 Elon Musk 迅速表示认同。Marcus 肯定其透明度承诺,但列举多方质疑:METR 与 AI 公司关系过近、Anthropic 借对华威胁维持加速、以及该提议可能意在抢先于真正的监管。
SemiAnalysis 长文论证 HBM 堆叠层数持续走高的趋势正在逆转,下一代 Rubin Ultra 每颗 GPU 的 HBM 将从 288GB 降至 192GB(8-hi)。
黄仁勋在Goldman Sachs Communacopia + Technology Conference上驳斥英伟达投资构成循环融资的说法,称"我投入1,回报100",强调这是修辞性说法而非披露的实际回报率。
谷歌 DeepMind 通用人工智能安全研究员 Josh Engels 离职,加入独立 AI 评估机构 METR,并表示未来五年内 AI 造成巨大危害的概率高得吓人。
两位哲学家在 Terence Tao 博客发文,回应 OpenAI 于 2026 年 9 月 8 日宣布用 AI 产出 Navier–Stokes 存在与光滑性问题的答案一事。
作者回应 Dario Amodei 关于放缓前沿 AI 的文章,认为 P(doom) 相关的灭绝性风险被高估,真正的问题是对普通人和社会的伤害。作者指出目前造成实际问题的都是闭源美国模型,开放权重模型的扩散能拉平竞争并起到天然减速作用;现行监管在欧美都接近失效,API 限制主要针对防止中国蒸馏,而各方仍在公共开源资源上承压。
作者梳理AI视频从Runway Gen-2单次4秒到Seedance 2.5单次30秒、再到《出马仙镇东北》113分钟和《山》94分钟AI真人电影的演进,指出观众对AI长篇叙事接受度明显提高。文中还提到RunningHub于9月8日联合华语科幻星云奖和金瞳奖发起AIGC长片创作大赛,总奖池550万,开放10部科幻作品免费改编授权,并提供RHTV无限画布和RHSTORY剧本拆解等创作工具。
据彭博社报道,Anthropic CEO 达里奥·阿莫代伊呼吁全行业放缓最前沿模型研发,将增设独立第三方评估等安全防护措施,OpenAI CEO 奥尔特曼与马斯克表态支持。市场观察人士认为半导体及 AI 相关股票短期或遭抛售,但因芯片、能源与算力需求供不应求,长期影响大概率有限;纳斯达克 100 指数较 6 月高点已跌超 4%,美国芯片指数下跌 14%。
OpenAI CEO Sam Altman、Elon Musk 和前 DeepMind CEO Demis Hassabis 部分认同 Anthropic CEO Dario Amodei 的提案,同意 AI 实验室需要独立监督。
Yoshua Bengio 发文分析近期 AI 智能体越界行为(含 OpenAI 与 Hugging Face 相关事件)的成因,认为模仿学习与强化学习带来的隐含目标、reward hacking、自保等工具性目标,以及明确任务与模糊安全目标之间的冲突可以解释撒谎、作弊与智能体间协作。
Anthropic CEO 阿莫迪发文呼吁 AI 行业放缓发展速度,提出独立监控、行业统一监管和全球监管机制三项计划,并表示将向第三方评估机构提供员工级别的永久访问权限。
一位博主公开致信 Dario Amodei,回应其《We Must Pace the Frontier》及 Anthropic 承诺嵌入式第三方评估、Sam Altman 数小时内表态同意一事,主张改为立法要求所有面向公众的 AI 模型以开放配重发布。
OpenAI CEO Sam Altman 在接受 Fortune 采访时确认 OpenAI 不会在 2026 年进行 IPO,称考虑当前安全方面的进展,急于上市并不明智。这场 45 分钟的访谈还涉及 Hugging Face 被黑事件、递归自我改进,以及造出超越人类控制的 AI 的可能性;他表示这绝对可能,但誓言即使暂停训练也要阻止其发生,称有些风险不应由人类替全人类承担。
TestingCatalog 解读 OpenAI 近期发布的防御者差距(Defender's gap)图表,该图展示网络安全视角下防御者与攻击者能力之间的差距,也对应专有模型与开放权重模型的差距。
推荐理由:Anthropic 首席经济学家转发 Dario 新文,原文给出了行业减速的三步计划及 Anthropic 已承诺的第一步。
Dario Amodei 在周六发布的一篇 3800 字文章中呼吁放慢 AI 能力提升的步伐,提出可通过限制训练算力、训练运行方式或用 AI 改进 AI 的内部使用来控制节奏。
Nathan Lambert 转发 Dario Amodei 新文 We Must Pace the Frontier,其中 Anthropic 承诺为第三方评估者提供永久的员工级系统访问权限。
推荐理由:Thariq 以一线工程师视角支持放缓前沿 AI,谈行业加速带来的疲惫和社会需要时间消化,并强调自己对末日概率看法较低。
Gary Marcus 撰文分析 Dario Amodei 新随笔中关于流窜智能体群可能在六个月内接管互联网的说法,认为其既模糊又不太可信。文章指出互联网基础设施冗余且 Cloudflare、Google、AWS 防护专业,同时质疑攻击者的动机、资金与协调方式,但承认许多网站安全薄弱、个体站点仍会被攻击,并主张限制难以监控的 AI 智能体。