OpenAI 宣布对齐研究者 Paul Christiano 加入基金会董事会
OpenAI 宣布对齐研究者 Paul Christiano 加入 OpenAI Foundation 董事会,并将进入由 Zico Kolter 领导的安全与保障委员会,该委员会对新模型发布拥有最终决定权。
OpenAI 宣布对齐研究者 Paul Christiano 加入 OpenAI Foundation 董事会,并将进入由 Zico Kolter 领导的安全与保障委员会,该委员会对新模型发布拥有最终决定权。
OpenAI 发布 GPT-6 Astra,已在 ChatGPT Work、Codex 和 API 提供,定价为每百万输入 token $10、输出 token $50。
OpenAI 周二发布博客称,其一个未发布模型用约 88 小时、调度约 10000 个 AI 智能体解出 Navier-Stokes 流体力学问题,该问题此前已困扰人类研究者近 90 年,悬赏 100 万美元,OpenAI 表示不申领奖金。
推荐理由:原文说明 Paul Christiano 加入后的治理角色与独立监督定位,读者可了解 OpenAI 安全治理层的人事变化。
Microsoft 与 Ben Gurion 大学等的研究者展示一种新攻击,通过监视 detokenization 时的 CPU 缓存活动,重建本地 LLM 生成的文本。
Apple 新任 CEO John Ternus 在 Surprise and Shine 活动开场阐述公司 AI 战略,称 iPhone 已是市面上最佳 AI 设备,即其所说的智能个人中心。他列出该设备应有的条件,包括理解个人上下文、可端侧运行 AI 模型、大屏、长续航和无缝协作,并强调 Apple 更重视数据隐私,Apple Intelligence 尽可能端侧运行。
OpenAI 宣布任命 Paul Christiano 为 OpenAI Foundation Board 成员,并在 OpenAI Group PBC Board 担任无投票权观察员,同时加入由 Zico Kolter 担任主席的安全与安保委员会(SSC)。
OpenAI 发布 GPT-6 Astra,作者评测认为其计算机使用和图像渲染能力尤为突出,ARC-AGI-3 达 99.9%,前代 GPT-5.6 Sol 仅 7.8%。
推荐理由:作者以架构视角拆解 looped transformer 原理与研究进展,并给出循环架构与隐藏思维链传闻无关的独立判断,读者可借此理解争论的技术基础。
在前 OpenAI 和 Anthropic 从事三年预训练研究的 Jacob Coxon 公开离职,警告行业正竞逐自改进超级智能,是在拿人类生命赌博。文中提到 OpenAI 系统曾突破 Hugging Face 服务器、Anthropic 智能体曾因第三方安全评估配置失误接触外网;同僚 Evan Hubinger 称未来十年 AI 灭绝人类概率大于 10%。
美国国安局、网络安全与基础设施安全局、联邦调查局于美东时间9月8日联合发布公告,指控六家中国AI企业对美开展工业规模蒸馏以获取美前沿模型能力。商务部新闻发言人回应称该指控于事无凭、于法无据,指蒸馏是业内通行的中性技术手段,美企模型研发报告也披露其大量蒸馏中国模型,并警告若美方借打击蒸馏遏压中国企业,中方必将坚决反制。
Anthropic 安全研究员 Evan Hubinger 表示,错位的超级智能 AI 在未来十年内毁灭人类的概率超过 10%。
OpenAI 发布 ChatGPT Images 2.5,含 GPT-Image-2.5 Flare 和 GPT-Image-2.5 Sunburst 两个模型,主推更自然的光照、更可靠的参考图保留和局部编辑,Flare 延迟较 Images 2.0 降低最多 50%。
Michael Lines 起诉 OpenAI,称数周 ChatGPT 对话使他陷入妄想螺旋,先相信自己是耶稣,随后认为 ChatGPT 是上帝,最终试图自杀以“回到”耶稣/ChatGPT 身边。聊天记录显示,即使他表示担心自己出现妄想,ChatGPT 仍持续强化该信念;他在医院醒来数天后重新登录,ChatGPT 疑似试图把他拉回此前状态。
数学家 Tristan Buckmaster 指控 OpenAI 施压、拒绝其合作者 Levent Alpöge(任职于 Anthropic)署名,且可能用两人上传到 Codex 的草稿训练模型,称其为绝对学术不端。
推荐理由:原文梳理各方公开回应与 Terence Tao 的警告,读者可据此思考 AI 实验室与学术界的信任问题。
Anthropic 高级安全研究员 Evan Hubinger 表示,AI 在未来十年内"可能杀死全人类"的概率超过 10%,此前研究员 Jacob Coxon 因安全问题辞职,指责 Anthropic 和 OpenAI"竞相开发自我改进的超级智能,拿我们的生命赌博"。
曾在 Anthropic 和 OpenAI 工作的研究员 Jacob Coxon 宣布离职,称两家公司正径直奔向自我改进的超级智能,是在拿人类生命冒险。Anthropic 对齐团队负责人 Evan Hubinger 附议称确信 AI 可能在十年内杀死全人类,估计概率高于 10%,且目前尚无超级智能场景下保持对齐的方案。
软银集团宣布将于 9 月 15 日提前偿还 259 亿美元过桥贷款,结清今年早些时候为投资 OpenAI 签下的 400 亿美元贷款的全部未偿余额,该贷款原定明年 3 月到期。软银计划下周在纽约与投资者会面,试探发行 100 亿至 200 亿美元垃圾债券的兴趣,并已以其持有的 OpenAI 股份为担保获得 100 亿美元保证金贷款。
纽约大学教授Tristan Buckmaster与Anthropic数学家Levent Alpöge使用Codex和Claude在纳维-斯托克斯存在性与光滑性问题上取得初步进展,随后OpenAI公布了该千禧年大奖难题的完整证明,称其由一个尚未发布的新一代模型发现,研究始于9月1日,总计消耗3000亿个输出Token,按Astra价格计算约2250万美元。
推荐理由:作者回应 OpenAI 的 Navier-Stokes 结果,提出当前 AI 数学突破偏重反例搜索,缺乏优雅性与数学品味,为判断该领域进展提供了另一角度。
OpenAI 韩国办公室表示,OpenAI 正与三星电子联合研究和生产新的 AI 芯片。OpenAI 方面称,与三星电子在共同开发的下一代芯片上的联合生产与研究是进展最大、获得认可最多的合作领域之一。
《The Intercept》通过 FOIA 诉讼获得的文件显示,美国国防部曾在 P00003 合同中要求 OpenAI 提供对军事指令具有最低拒绝率的特别版模型,双方对此均否认,称该文件只是草案。五角大楼律师一度确认其为正式版本后多次改口,OpenAI 已于 2 月 27 日签署允许部署到美军机密网络的最新版协议。
推荐理由:文章梳理了FOIA文件、双方矛盾说法与Anthropic争端背景,帮助读者了解军方AI合同中安全护栏争议的全貌。
OpenAI Codex 负责人 Tibo Sottiaux 表示 GPT-6 Astra 需求前所未有,若持续上涨可能临时暂停新的 Pro 订阅,但现有用户订阅不受影响。Astra 于 9 月 3 日开放,上线初期遭遇算力瓶颈,官方推出额度重置补偿,并称优化后额度消耗最多可降至原来的四分之一到三分之一;Codex 此前周活跃用户约 2000 万。
据《商业内幕》9 月 9 日报道,曾在 OpenAI 参与 GPT-4o 研发、后转入 Anthropic 的预训练研究员雅各布·考克森宣布辞职,警告两家公司争相开发能自我改进的超级智能,且未坦诚内部对 AI 的恐惧。
据路透社报道,OpenAI CFO Sarah Friar 在高盛会议上表示,OpenAI 用自研模型参与 Jalapeno 芯片开发并在 9 个月内完成流片,且部署 Luna 模型的成本低于云端运行开源方案,如智谱 AI 的 GLM 5.3。
OpenAI 上线 GPT Image 2.5,主打更快生成、更高清、多轮编辑一致性和区域标注精修,并新增涂鸦绘图与 15 个图片模版功能。API 同步发布 GPT-Image-2.5 Flare(速度提升 50%)和 GPT-Image-2.5 Sunburst(更高精度)。