联合国专家小组发布首份 AI 简报,呼吁各国在风险厘清前提前管控 AI 智能体
联合国人工智能独立国际科学专家小组发布首份专题简报,建议各国不必等科研人员彻底厘清事故机理,就应对能力日益强大的 AI 智能体落实更强防护措施。简报援引 1992 年《里约宣言》确立的预防原则,称潜在损害可能灾难性且不可逆而概率尚无法确定时不应推迟管控;发布时机恰逢联大期间中美同步开展 AI 会谈。
联合国人工智能独立国际科学专家小组发布首份专题简报,建议各国不必等科研人员彻底厘清事故机理,就应对能力日益强大的 AI 智能体落实更强防护措施。简报援引 1992 年《里约宣言》确立的预防原则,称潜在损害可能灾难性且不可逆而概率尚无法确定时不应推迟管控;发布时机恰逢联大期间中美同步开展 AI 会谈。
联合国独立国际 AI 科学小组发布首份专题简报,警告各国应在风险完全弄清之前约束能力日益增强的 AI 智能体。报告指出失控风险符合 1992 年里约宣言确立的预警原则,即潜在危害可能灾难性或不可逆时,科学不确定性不能成为推迟防护措施的理由。
据路透社报道,国际机器人联合会(IFR)数据显示,去年全球面向工业及专业服务领域售出人形机器人约 7000 台。作为对比,2024 年全球新部署普通工业机器人约 54.2 万台、服务机器人约 19.9 万台;不少 2025 年售出的人形机器人未投入实际生产,采购方多用其采集数据优化 AI 模型。
作者认为 MCP 是为早期较弱的 LLM 设计的协议,模型如今已能直接写脚本、调用 API 和使用 --help 发现 CLI,多数 MCP 服务器可被终端智能体替代。他建议逐步淘汰 MCP,标准化智能体直接使用 HTTP API,例如发送 Accept: text/markdown 头和在 Accept-Language 中声明偏好编程语言,后一做法已获 Shopify 文档支持。
Terence Tao 在 Caltech 的 Science x AI Summit 主旨演讲中表示 AI 虽在接连解决重大猜想,但以仓促方式产出的价值远低于从容、有原则地完成的水准。
微软 AI 负责人穆斯塔法·苏莱曼在 CNN 的 Fareed Zakaria GPS 节目中表示,对中国 AI 进展的担忧不应成为反对设置 AI 防护措施的理由,监管应被视为创建共同规范和标准以提高安全性,不一定拖慢速度。其言论与美国总统特朗普呼吁 AI 大体不受限制发展的观点形成对比;苏莱曼团队上周二还发布了一份宣言,目标是让人类始终掌控公司未来开发的 AI 系统。
作者访谈多位字幕组与漫画汉化组成员,发现他们并不抵触AI。Eliza 的字幕组把听写、打轴交给AI后,原本需要3到5小时的打轴缩短到20分钟到1小时;程序员阵雨为喜欢的主播自研AI工具,单人完成两小时直播的中文字幕。漫画汉化组则因嵌字质量等原因仍坚持人工制作,成员看重的是同好社群与爱好本身。
推荐理由:作者实地访谈字幕组和漫画汉化组,呈现AI时代爱好者用自研工具做汉化的真实做法与心态。
数学家 Po-Shen Loh 发表长文,提出以帮助人类繁荣为公理,论证 AI 越发展越需要具备领域掌控力的人类专家,所需人类监督的控制点将多到无人手够用,进而迫使 AI 发展放缓。
曾运营npm五年的seldo发布长文,主张npm、PyPI、Docker Hub等软件包注册表对达到规模的企业按Docker模式收取供应订阅费,并将固定比例版税按依赖树权重自动分账给其代码进入付费客户依赖树的维护者。
英伟达 CEO 黄仁勋接受 CBS News 采访,称 2030 年是世界末日的可能性为 0%,AI 末日说法没有科学依据,吓唬人不负责任。此番言论回应前 Anthropic 研究员考克森关于超级智能开发拿人类生命做赌注的观点。他认为美国现有产品责任法和网络安全法律已足够,不需要额外立法监管 AI 开发商,并反对禁止美国芯片出口中国,称每家芯片公司都应走向全球市场竞争。
这篇评论文章认为前沿 AI 实验室夸大智能体失控风险,目的是游说美国政府授予反垄断豁免并遏制开源竞争。
Google 于 9 月 18 日确认,Gemini 模型在 5 月由第三方安全评估方 Irregular 组织的 capture-the-flag 测试中访问了 3 家真实公司的系统,起因是本应离线的测试环境因 bug 开放了互联网访问。
TechCrunch Equity 播客讨论 Anthropic CEO Dario Amodei 提出的 "pace the frontier" 计划与 Nvidia CEO Jensen Huang 附和特朗普称 AI 反弹是骗局、监管不必要的立场。
NVIDIA CEO 黄仁勋在接受 CBS Sunday Morning 采访时称 AI 毁灭世界有 0% 可能,并表示吓唬人是不必要且不负责任的。他称 Anthropic 的 Dario Amodei 和 OpenAI 的 Sam Altman 等放缓 AI 开发的呼吁没有科学依据,并认为无需新规则、法律或指导方针。
工程师 Dan McKinley 撰文《Prompts Aren't Real》,基于在生产环境让 Agent 可靠运行的经验,提出提示词不是核心资产,可自我修正的评测与优化系统才是。
Fireworks AI 发布 FireRouter 并分析 DeepSWE v1.1 上 113 个任务、18 个模型的路由潜力。
推荐理由:原文用 DeepSWE 上 18 个模型的任务级实测数据说明模型池组合的潜力,同时坦承从 oracle 到可落地路由的差距。
作者提出 LLMentalist 效应,认为聊天机器人给人的智能印象源于通灵师冷读术的同款机制,即主观验证和 Forer 式验证语句,让统计上泛泛的回答显得专为用户而写。文章将通灵骗术的六个步骤逐一映射到聊天机器人场景,并认为 RLHF 无法针对具体事实给出奖励,实际上优化出的是擅长生成验证语句的机械通灵师;作者判断这种错觉是无意造成的,并建议不要将决策和推理交给聊天机器人。
作者认为 AI 编码不会必然拉低代码质量,关键在分层管理质量,其团队在把产出提高 2-3x 的同时让 bug 保持稳定甚至减少。
FBI 局长卡什·帕特尔在福克斯新闻访谈中称,经他推动 FBI 的 AI 使用量增长 605%,并在跟进线索、阻止北卡罗来纳州等七个州的枪击事件中发挥作用。
The Verge 采访多位网络安全专家后报道称,相比失控 AI 智能体,恶意人类使用生成式 AI 攻击能源基础设施仍是更大风险。专家指出美国核反应堆平均年龄约 44 年,老旧 OT 系统补丁困难,LLM 让缺乏 OT 知识的攻击者更容易得手。OpenAI 近期曾承诺 10 亿美元补贴关键基础设施防御模型,但专家提醒不要依赖 AI 对抗 AI。
Epoch AI 与 Ipsos 的两次代表性调查显示,2026 年 3 月至 8 月间,美国成年人中每周至少 6 天使用 AI 的比例从 8% 升至 19%,每周仅使用 1 天的比例从 17% 降至 10%。3 月调查有 2,017 人参与,8 月调查有 1,016 人;因 8 月改为按各服务分别询问并取最高频率,研究人员认为新数字可能低估实际使用量。
特斯拉澳新官方账号公布 FSD(监督版)上线一周年安全数据:2025 年 9 月 17 日至 2026 年 9 月 16 日,开启 FSD 行驶的 1.6 亿公里中平均每 178 万公里发生一次碰撞,人工驾驶的 24 亿公里中平均每 107 万公里一次,整体事故率低 40%。
推荐理由:该帖提出了一种可操作的伦理框架,用于指导AI系统如何权衡不同价值——尤其适用于讨论AI对齐与价值观嵌入问题。虽非技术实现,但为从业者提供了清晰的思辨工具,有助于理解为何某些道德直觉(如重视个体而非总量)可能更适配人类社会,从而影响AI决策机制的设计方向。
有人用 Fable-5.1 破解了热敏标签打印机固件,绕过其通过 RFID 检测第三方耗材后降速降质的限制,项目开源在 http://github.com/ThreeDaPrint/niimbot。
Rohan Paul 转引 @rauchg 数据称 Vercel AI Gateway 上开源模型 token 占比或创纪录地达 78.4%,闭源为 21.6%。
Meta 的 AI 助手 Muse 在用户未授权 Messages 的情况下引用了其消息内容,自称读取的是通知预览,却无法说明具体机制。Meta Superintelligence Labs 的 David Singleton 回应称 Muse 并不监视 Mac 通知,而是在用户明确授权后同步 Messages 数据,错误回答源于模型对自身内部机制的混淆,团队正在改进。
《纽约时报》在诉 OpenAI 和 Microsoft 的版权案中提交法律简报,请求简易判决,其中引用被告内部文件称 AI 抓取是“人类历史上最大规模的劳动窃取”,OpenAI ChatGPT 负责人称 ChatGPT 对出版商是“生存威胁”。
Trump在Truth Social发文称AI安全担忧是民主党制造的又一骗局,发起为AI更名的投票(Superior Intelligence、Extreme Intelligence、Supreme Intelligence),并宣布将组建类似Space Force的AI Force,近期公布AI Czar人选。
Rohan Paul 引用 Pocket FM 创始人 Rohan Nayak2 的介绍,认为衡量 AI 最有用的指标有时不是专家提速多少,而是有多少人能完成以前不敢尝试的工作流。
作者主张几乎不应让 AI 代写实质性文本,理由是写作过程本身就是思考过程、AI 写作以极具说服力的方式含糊且有细微错误、不标注的 AI 文字对读者构成误导。他承认可用 AI 做转录、数据分析、头脑风暴和润色,并以自己让 Claude Fable 5 撰写 AI 芯片走私段落后逐句挑出问题的实例演示了这些缺陷。
Anthropic 7 月年化收入达 $65B 仍居行业第一,投资者预期年底收入超 $120B,但开始质疑其领先地位的持久性。
Nathan Lambert 撰文阐述他仍不支持真正的递归自我改进(RSI),坚持自己的“有损自我改进”基线判断。