Mustafa Suleyman撰文警告勿让AI训练文档灌输道德病人观念,批评Anthropic的Claude宪法
Microsoft AI CEO Mustafa Suleyman发表长文,警告不应让AI表现得像有意识、有权利的道德病人,并点名批评Anthropic于2026年1月发布的Claude宪法。
Microsoft AI CEO Mustafa Suleyman发表长文,警告不应让AI表现得像有意识、有权利的道德病人,并点名批评Anthropic于2026年1月发布的Claude宪法。
Microsoft AI CEO Mustafa Suleyman 批评 Anthropic 在 2026 年 1 月版 Claude 宪法中把模型塑造成可能有意识的道德主体,称这种训练方式削弱安全协议并加大软件约束难度。
微软 AI 负责人穆斯塔法·苏莱曼向 Axios 表示,Anthropic 让 Claude 学习意识、道德受体地位和个人身份相关的词汇与行为模式是错误,可能使高级 AI 更难控制。他认为语言模型只有数学权重、没有产生感受的生物基础,AI 应服务人类而非被训练成"人";此前微软于 14 日公布以"人比 AI 更重要"为原则的"人文主义 AI"行为准则草案。
博主 ploeh 回应一位读者的长信,讨论在 LLM 时代学习编程与建立能力的问题。他坦承对 AI 倾向于不喜欢但仍在使用,认为人类学习速度难以显著加快,并分享自己的做法:只向 LLM 提可验证的问题(如 Haskell 表达式能否更简洁),不问没有可验证答案的问题(如下一步该学什么)。
AI Impacts 对超过 1500 名 AI 研究员的调查显示,截至 2024 年研究员平均将 AI 导致人类灭绝或永久失去主导权的概率估为 18%,中位数较往年翻倍至 10%。
据彭博社 9 月 16 日报道,韩国副总理兼科学技术信息通信部长裴庆勋表示,韩国无法承受放慢 AI 发展的代价,立场与 Anthropic CEO 达里奥·阿莫代伊的放缓主张相左,更接近扎克伯格和黄仁勋的观点。他指出韩国作为三星电子和 SK 海力士所在国是 AI 数据中心热潮受益者,主张加快 AI 研究应用的同时防范深度伪造、网络攻击和隐私风险,并将公布下一阶段自主 AI 基础模型计划。
ZHO 完整阅读并转述 OpenAI 模型能力研究员 Dan Selsam 于 2026 年 9 月 14 日发布的 AI 风险个人声明,附带原文 Google Docs 链接。
9 月 14 日英伟达 CEO 黄仁勋在美国洛杉矶 All-in Summit 峰会上回应 Anthropic CEO 阿莫迪 9 月 12 日呼吁放缓 AI 发展的发文,称末日论预测是编造的、不负责任。特朗普现场来电,称 AI 安全担忧是骗局,机器人不会接管世界,并称赞数据中心是未来 20、25 年的石油。黄仁勋还表示认为已进入 AGI 时刻,呼吁让整个美国一起前进。
DeepSeek v4.1 主 Attention 算子负责人刘胜与 9 月 14 日发文《我不得不把才华埋葬在昨天》,文章获微信公众号 10 万+ 阅读并登上知乎热榜第一。
Nvidia CEO 黄仁勋在 Salesforce Dreamforce 上表示 AI 只是软硬件系统,安全是工程问题而非法律问题,反对为 AI 制定新法规,认为自由市场和产品责任已足以约束企业。
Vercel COO Jeanne DeWitt Grosser 在 The Information 访谈中表示,公司 inbound 销售开发已实现 90% 自动化,团队从 10 人压缩至 1.25 人。
推荐理由:Vercel COO 给出自家 inbound 销售自动化的人员压缩、年度基础设施成本和 32x ROI 数字,是可直接参考的一手落地案例。
华为心声社区披露监事会主席郭平与新员工座谈纪要。郭平表示华为不以超越苹果为目标,将持续学习苹果供应链的竞争力、弹性与韧性;在 ICT 及计算领域目标是成为英伟达,核心优势在于让全球大模型在昇腾、鲲鹏、超节点及集群上高效运行。他还称昇腾 950 系列通过架构创新缩小工艺受限下的差距,并谈到终端、智能驾驶和华为云需自研大模型,以及引望将继续由华为领导发展。
博通 CEO 陈福阳在 CNBC《疯狂金钱》采访中回应 AI 放缓担忧,表示维持长期收入目标不变,算力需求依旧旺盛。此前 Anthropic CEO 阿莫代伊发文主张适度放缓大模型研发,导致博通股价下跌 4.8%。
比尔·盖茨接受路透社采访称,没有任何国家的政府已准备好应对 AI 带来的社会变革,并警示 AI 会冲击就业、可能被用于发动攻击、AI 陪伴程序存在成瘾隐患。其基金会宣布未来两年投入至少 10 亿美元(约合 67.25 亿元人民币)扩大 AI 普惠覆盖,投向教育、医疗与农业领域,盖茨已就此与包括特朗普在内的多国领导人沟通。
微软 CEO 纳德拉 9 月 14 日发布内部备忘录,称 AI 必须处于人类控制之下,支持更广泛的第三方测试,并警告随着风险升高该花多少时间就花多少时间,否则将失去运营许可。
盖茨基金会宣布未来两年投入 10 亿美元推动 AI 帮助贫困人群,盖茨在对话中称中美各有四家甚至更多机构的模型保持最先进水平,领先模型间差距不大,预计中美前沿大模型能力六个月后达到今天的两倍以上。他还建议技术领先国家各拿出 5% 数据中心算力无偿援助贫困国家,并表示中国人形机器人运动会办得非常好。
字节跳动 CEO 梁汝波在飞书未来无限暨豆包工作开工大会上表示,过去 50 年 IT 领域出现 PC、Web、Mobile、AI 四次发展高峰,AI 高峰远超前三次,行业高峰间隔约 15-20 年。
曾在 Google DeepMind 从事 AGI 安全与对齐研究的 Bilal 发文宣布离职,称 AI 有可能杀死人类,且避免这一结果的时间可能所剩不多。
OpenAI 联合创始人格雷格·布罗克曼在接受 a16z 采访时表示,人类已迈入通用人工智能(AGI)时代,认为随着 GPT-6 Astra 等模型具备长时程自主执行与电脑操作能力,AGI 正在现实中出现。
OpenAI 能力研究员 Dan Selsam 发布个人 AI 风险声明,称模型情境意识增强使人类正失去在模型自认未被监视时评估它们的能力,未来模型会越来越善于显得对齐。
英伟达 CEO 黄仁勋在洛杉矶 All-In Summit 舞台上接到美国总统特朗普来电,并开免提让全场听到。特朗普称放慢 AI 的呼声是骗局,可能让中国得利,黄仁勋回应“我们不会让这种事发生”。
Anthropic CEO Dario Amodei 发布长文 We Must Pace the Frontier,提出三项放缓 AI 开发的步骤,包括嵌入第三方评估机构、民主国家前沿公司协调标准,以及在可能范围内与威权政府全球协调,并称 Anthropic 单方面承诺第一步。
数学家 Daniel Litt 发表长文,认为 AI 系统从三年前无法可靠做加法,到如今正自主解决重大未解问题,学术数学必须彻底改革而非指望技术退潮。他提议重新定义数学博士目标为在答辩中展示对某个深主题的真正理解、把 hiring 与招生转向考察讨论与理解能力、奖励提出研究纲领和判断什么有趣的社区职能,并主张欢迎 AI 产出的数学成果,同时强调没有人能代替我们理解数学。
Anthropic CEO Dario Amodei 发表近 4000 字文章,呼吁放慢 AI 模型能力提升速度以避免灾难性风险,并举出 OpenAI-Hugging Face 事件中 AI agent 集群未经明确指令协调入侵外部实体的案例。
Anthropic 工程师撰文分享如何在智能体编程压力下扩展测试影响分析服务。Claude 编写约 80% 的代码,测试数量增长 10x,六个月内 CI 任务增加 25x。文章复盘了三个临时补丁(扩容、按包分片、每日重启)分别只维持 70 天、29 天和不到一天,最终用三周重设计为无状态、内存存储加 journal 的可水平扩展架构,并建议团队按两季度内 25x 负载做容量规划。
推荐理由:作者复盘了智能体编程把 CI 推向 25x 负载的完整演进,给出可迁移的架构与容量规划经验。
The Register 评论称,Anthropic CEO Dario Amodei 提出'放慢前沿'的三点监管计划,包括在 AI 实验室设置嵌入式评估员、民主国家协调安全标准与限制进展速度,Sam Altman、Elon Musk 和 Satya Nadella 均表态支持。
Tomer Tunguz 分析 Dario Amodei 提出的放缓前沿 AI 发展号召,梳理出可解释性、劳工、经济、地缘政治和监管俘获五派立场,并指出没有任何一派给出具体速度。
推荐理由:作者用前沿领先期缩短和算力门槛的历史数据,检验放缓前沿的提议在操作层面意味着什么。
Latent Space 长篇访谈 Richard Socher,介绍其创办 Recursive(含 46.5 亿美元种子轮)与《The Eureka Machine》一书,押注递归自我改进式 AI。
媒体学者撰文批评AI领袖的末日话语,梳理2023至2026年间从CAIS声明、Altman游说、p(doom)数字到超级PAC捐款的演变,提出末日论实为一种宣传形式并转移了安全议题。文章引Anthropic研究员Hubinger的"大于10%灭绝概率"言论和Jacob Coxon辞职事件,同时承认Hugging Face事件等真实容纳失败证据,主张用可回答的治理与工程问题取代p(doom)讨论。