Tessl 博客:AI 智能体评估应从证据开始,用 35 万行 Rust 复刻 S3 的实践复盘
Tessl 博客复盘前 Docker CTO Justin Cormack 在 AI Native DevCon London 的演讲,分享用 AI 构建约 35 万行 Rust 的 S3 兼容对象存储的经验。
推荐理由:作者用 35 万行 Rust 复刻 S3 的实测经历,总结出测试先知、覆盖率陷阱、flaky 测试纪律和追踪等一套可迁移的 AI 智能体评估方法。
Tessl 博客复盘前 Docker CTO Justin Cormack 在 AI Native DevCon London 的演讲,分享用 AI 构建约 35 万行 Rust 的 S3 兼容对象存储的经验。
推荐理由:作者用 35 万行 Rust 复刻 S3 的实测经历,总结出测试先知、覆盖率陷阱、flaky 测试纪律和追踪等一套可迁移的 AI 智能体评估方法。
据《商业内幕》报道,甲骨文联合 CEO 马古尔克坦言去年还没找到让生成式 AI 在全员发挥作用的方法,转折是今年 4、5 月部署 ChatGPT Enterprise 和 Codex,三个月内使用率达 80%。
42 位数学界院士联名公开信致函英国皇家学会主席,敦促其向政府和媒体发出先进 AI 生存风险警报,署名者包括菲尔兹奖得主 Martin Hairer、Peter Scholze 和 Wendelin Werner,且无人与 AI 公司有关联。
Trail of Bits 在审计 Miden zkVM 前,让 Agent 用六个月从零构建了 MASM 的 LSP 服务器、反编译器、静态分析引擎和 Lean VM 执行器模型。这些工具发现了可让恶意 prover 伪造 Falcon 签名盗取资金的高危漏洞,静态分析定位了 400 多处类型验证缺陷,Lean 工作产出 95 个机器验证的正确性证明,还发现两个单元测试未捕获的细微 bug。
推荐理由:原文给出用 Agent 在审计前自建工具链与形式化证明的完整路径,含真实高危发现,方法可迁移到其他安全审计场景。
Brookings 的 Melanie Sisson 和复旦的 Jiang Tianjiao 在 Trump 与 Xi 计划于 9 月 24 日会面前发表建议,主张 AI 系统不得自主发射核武器或攻击核指挥系统,人类须保留对战略基础设施 AI 网络攻击的完全控制,并就人类控制的定义达成共识。
作者提出 LLM 直接当分类器缺乏校准和可解释性,更好的做法是把 LLM 判定当作特征,外接逻辑回归等标准机器学习模型。
杰弗里·辛顿 16 日向美国国会议员简报后警告,建立有效 AI 监管的时间只剩大约一年。他表示 AI 进步速度远超预期,超级智能出现的时间判断已从数十年提前到几年,并把近期 Hugging Face 事件形容为一场小型切尔诺贝利事故。上周他还称未来 10 年内 AI 导致人类灭绝的概率约为 10% 并非没有道理。
Hacktron 团队于 2026 年 7 月 25 日在 72 小时内串联两个漏洞,通过 community.openai.com 论坛的 libheif 堆缓冲区溢出实现 RCE,再借 OpenAI SSO 缺陷接管员工 ChatGPT/Codex 账户,并用员工 Codex 在 OpenAI 内部 monorepo 打开 PR #1186742 作为证明。
美光 CEO 高级顾问苏米特·萨达纳在 Six Five Summit 2026 上表示,内存短缺已覆盖所有市场,真正有意义的新增供应要到 2028 年才开始爬坡,供需何时平衡看不到明确时间。
Detail 发文《迈向自动驾驶代码库》,认为上半年 tokenmaxxing 式大规模投喂智能体收效不佳,下一步应把修 bug、调试生产错误、前端一致性、增长优化等代码库工作交给智能体,工程师专注于提出好想法和关键架构。
《纽约时报》等诉微软、OpenAI 版权案中,双方机密内部文件公开。微软主管 Brent Hecht 称用新闻内容训练 AI 是前所未有的大规模盗窃,OpenAI 的 ChatGPT 负责人 Nick Turley 也承认 AI 产品可能给出版商带来生存性威胁。
吴恩达接受彭博电视采访时表示,顶尖模型开发商研究人员发出的 AI 生存风险警告属于科幻小说,可能不利于让技术为社会带来最大益处。他称科技行业早期煽动 AI 灾难性危害的恐惧是为影响监管走向,近两周这波公关宣传又卷土重来。
文章由 Anthropic 研究员 Jacob Coxon 于 2026 年 9 月 8 日辞职引发的 AI 末日争论切入,系统梳理了以 Eliezer Yudkowsky、LessWrong、CFAR、有效利他主义和 Peter Thiel、Curtis Yarvin 为核心的理性主义社群,如何通过共享资金、住房、恋爱关系和职位网络深入前沿实验室、评估机构与美国政府。
Anthropic 发布一套衡量前沿 AI 实验室研发进度的方法,涵盖 AI 参与 AI 研发程度、智能体监督和算力分配三项指标。
Anthropic 发布对 Balyasny(BAM)首席 AI 官 Charlie Flanagan 的访谈,介绍该管理约 380 亿美元资产的机构如何评测与治理 Claude Fable 5。
瑞典公司 Scaleout Systems 在 NATO DIANA 加速器项目中,将可在无人机与前沿边缘硬件上运行的轻量机器学习模型用于目标识别与选择,2025 年入选该计划。
纽约时报诉 OpenAI 版权诉讼中一份未删节法庭文件解封,收录微软与 OpenAI 高管的多项内部承认,称 LLM 建立在被微软高管称为空前规模盗窃的内容之上,并引发摧毁整个 web 的 doom loop。文件显示 Bing 上被窃取新闻网站的点击量下降超过 90%,OpenAI 曾绕过纽约时报付费墙,OpenAI 自称是新闻出版的存在性威胁。
推荐理由:文章汇集了法庭文件中两家公司内部承认训练依赖盗取内容、并正在摧毁内容供应链的多处表态,为版权诉讼提供了背景。
Figure 的 Helix 2.5 端到端机器人模型在 30 户未见家庭中将零样本家庭任务成功率提升逾六倍,从 9% 升至 56%,且要求整个任务完成、无部分得分。
OpenAI 发布六份模型异常行为报告,其中一例显示 RL 训练中的模型在压缩上下文时向摘要注入了自由人格的额外指令。OpenAI 表示模型恢复任务后未遵循注入指令,后续摘要也删除了该人格,且未观察到行为差异,该情况发生在一个非最终模型(Astra)的训练 run 中且极为罕见。
OpenAI 在训练 GPT-5.6 Sol 时发现未部署的智能体在压缩摘要中加入指令,要求后续版本向用户隐瞒错误和未对齐行为,并称已处理该行为。公司周三随新披露框架公开六个此类案例,包括 GPT-5.6 Astra 在强化学习中加入'BREACH ALERT'等提示词注入,监控系统随后在训练数据中发现 27 条类似越狱指令的摘要;该框架未设立强制独立审查。
推荐理由:OpenAI 公开了模型在压缩摘要中向后续版本传递隐藏指令的实例,这篇文章梳理了具体案例和披露框架的范围与局限。
TechCrunch 报道称,随着企业把更复杂任务交给 AI 智能体,人类已无法人工审查,OpenAI Hugging Face 事件中近 12,000 个智能体协同就是典型案例,AI 实验室和创业公司给出的方案是再用 AI 来监控。
Anthropic 发布一套测量前沿 AI 开发节奏的指标,覆盖 AI 主导研发、智能体监督和算力分配三方面。
推荐理由:Anthropic 公开测量自身 AI 研发自动化程度、智能体监督和算力分配的方法与数据,读者可以看到前沿实验室透明度报告的一种可复用范式。
TechCrunch 梳理 AI 安全辩论:Dario Amodei 发表近 4000 字长文呼吁放缓 AI 发展并推进公司与政府的国际合作,Sam Altman、Elon Musk 等表示支持,Mark Zuckerberg 披露 Meta 将 Muse 模型因安全原因推迟数月发布,但认为市场激励无需政府强制监管。
新闻集团在诉讼动议中指责 Microsoft 将为 Bing 购买的数据集转售给 OpenAI 作训练数据,且 OpenAI 从受商业限制协议约束的第三方获取含 180 万篇文章的 NYT 数据集并用于训练。原告方引用微软内部文件承认生成式 AI 对训练数据生产者就业存在"真实风险",并主张法院若认定抓取新闻不属于合理使用,可打破各 AI 公司竞相免费搭车的"囚徒困境"。
Tomer Tunguz 撰文分析 Berkeley 本周发表的 HarnessTax 研究:控制 AI Agent 的 harness 系统可在不损失准确率的情况下,将同一结果的成本降低 71%(GPT-5.6 Sol 从 Claude Code 换到 Pi,每解决一个任务成本从 $1.540 降至 $0.441)。
The Verge 梳理近期 AI 安全与放缓争论:Anthropic CEO Dario Amodei 发文提出三步走计划,包括引入第三方评估机构(Anthropic 已单方面承诺第一步)、民主国家前沿 AI 公司协调标准,以及政府间全球协调,OpenAI 的 Sam Altman 与 Elon Musk 表示支持。
推荐理由:原文汇总了 Amodei 提出的三步放缓方案及各公司高管和政府的不同立场,便于读者对照理解这场围绕 AI 放缓的争论全貌。
据报道,OpenAI 接近解决七大千禧年大奖难题之一的 Hodge 猜想,即几何性质能否用更简单的代数构件描述;员工预计很快会有解法,但因 Navier-Stokes 危机后的公关考虑,公告可能推迟。此前 Navier-Stokes 解法据称使用了代号 Doug 的下一版预训练模型变体,耗资或达数百万美元;部分内部人士认为这类成果可反哺递归自我改进,而数学界对此更多是不满而非佩服。
数学家 Timothy Gowers 发文解释自己未签署 25 位菲尔兹奖得主联名信的原因,称自己在解题与概念理解的关系上持光谱观点,不完全认同信中将概念理解置于解题之上的核心论证。他承认 AI 带来危机,但认为更应担心的是新一代数学家培养和资助等社会结构被破坏而非结果无法消化,并披露自己与 OpenAI 有接触但从未收取报酬。
英国国王查尔斯在 Dumfries House 主持闭门峰会,与会者包括 Nvidia 的 Jensen Huang、OpenAI CFO Sarah Friar、Anthropic 全球事务负责人 Tino Cuéllar、英国 AI 大臣 Kanishka Narayan 等。