特朗普推出 AI 安全自我监管承诺,六家科技公司高管表态
特朗普在白宫与 Google、Anthropic、Meta、OpenAI、xAI、Nvidia 六家公司高管会面后,宣布以《前沿责任联合承诺》取代联邦 AI 监管,该承诺属道德约束性质,企业自行制定安全准则,违约似无后果。
特朗普在白宫与 Google、Anthropic、Meta、OpenAI、xAI、Nvidia 六家公司高管会面后,宣布以《前沿责任联合承诺》取代联邦 AI 监管,该承诺属道德约束性质,企业自行制定安全准则,违约似无后果。
OpenAI 在年度 DevDay 大会上发布由 GPT-6 Astra 驱动的智能体 Dots,定位为可委派复杂工作的“幕僚长”或资深工程师,目前仅面向每月 100 美元的 Pro 套餐用户开放。
Graphite 研究发现 Claude Opus 5.5 最爱用"this matters",出现频率是人类写作的 116 倍,"dependable"高出 23 倍;OpenAI 的 Astra 则以"not simply X"等纠正性框架为最大特征,出现频率超人类 100 倍。
OpenAI 在 DevDay 2026 上发布 Dots 常驻智能体、GPT-6.1 Sol、Ultrafast 模式、Decisions API、ChatGPT Spaces 与 Marketplace,并称 ChatGPT 周活达 12 亿。
推荐理由:汇总 OpenAI DevDay 2026 的发布清单与第三方评测数据,可一次看清产品线变化和定价调整。
AWS 博客给出 Claude Platform on AWS(CPonAWS)多环境访问的完整实施步骤:在组织内建专用 AI Services 账户承载订阅与工作区,工作负载账户通过跨账户 SigV4 角色调用推理,无需存储 API key。
Amazon Bedrock 在印度上线 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,通过地理跨区域推理让请求仅在 ap-south-1 与 ap-south-2 之间路由,数据留在印度境内。
Amazon Bedrock 现支持在首尔和新加坡区域进行区域内推理的 Anthropic Claude 模型:首尔支持 Claude Opus 5 和 Claude Sonnet 5,新加坡支持 Claude Sonnet 5,均通过 bedrock-runtime 端点调用。
Anthropic 前沿红队在内部 Binary Exploitation benchmark 中随机抽取 100 个任务评测多个模型,GLM-5.3 在 4% 的试验中实现了完整的控制流劫持,Claude Mythos Preview 为 6%。报告指出,此前的 Claude Opus 4.6 和 GLM-5.2 在这些任务中无一成功,说明一个有意义的能力门槛已被跨过。
VC Tomer Tunguz 分析认为 2026 年 AI 竞争重心从技术创新转向商业模式创新。Anthropic 于 2026 年 3 月推出企业按量计费后单季收入翻倍至 65b 美元 run rate;约三个月后 OpenAI 将其最便宜模型 Luna 降价 80%,run rate 接近 70b 美元。
推荐理由:作者用两条定价动作串起 Anthropic 与 OpenAI 的收入变化,并提示毛利率才是比较两者实力的更好指标。
Anthropic 发布对智谱 GLM-5.3 网络攻击能力的分析,发现其可自主开发端到端漏洞利用,在 ExploitBench 410 次尝试中成功 50 次,接近 Claude Mythos Preview 的 56 次。
推荐理由:Anthropic 第一手评测给出 GLM-5.3 的漏洞利用成功率和防护绕过数据,读者可据此了解开放权重模型带来的攻击面变化。
AWS 发布基于 Amazon Quick 与 Amazon Bedrock AgentCore 的合同智能平台参考架构,用 AI 智能体从合同 PDF 中提取结构化字段并交叉验证,解决 RAG 无法跨数百份合同做聚合统计的问题。
Anthropic 报告 Claude.ai、Claude API、Claude Code 和 Claude Cowork 出现错误率升高,14:00 UTC 起部分用户无法登录、开启新对话、语音对话、购买和上传文件,14:36 UTC 首次缓解,14:59 UTC 大部分服务恢复。官方称 14:00 至 14:59 UTC 之间发送的部分消息可能未被保存,目前仍在持续监控。
Asana 让 AI 智能体直接运行在其 Work Graph 模型内,与人类同事一样拥有角色、任务、消息读写和活动流记录,并由 Claude 驱动复杂任务。每个智能体按内容撰写、洞察分析、项目管理等角色预置技能与集成,其实际访问权限受触发者权限约束。智能体的共享记忆仅允许管理员和编辑者写入永久记忆,普通成员反馈只作用于当前任务。
据 Axios 援引知情人士报道,OpenAI 年化经常性收入(ARR)已接近 700 亿美元,自 2026 年三季度初以来增长超 70%,其中 B2B 收入增长超 100%,三季度消费者业务新增收入超 2025 年全年。
Anthropic 的 IPO 招股书包含对人类灭绝风险的警告,现任与前员工公开警示失控 AI 可能在十年内危及人类,Amodei 上周在联合国安理会称 AI 是当今最重要的全球安全问题。
三位湾区科技从业者组成 DrivingBench,用 Comma 套件把 GPT-6 Astra、Claude Fable 5.1、Grok 4.6 和 GPT-5.6 Sol 接入丰田卡罗拉的转向、油门和刹车,在公共停车场锥形路线上测试未专门训练的前沿模型能否开车。
Anthropic IPO 招股书内容曝光,公司拟以 2 万亿美元估值上市,2025 年营收增长 12 倍至近 46 亿美元,但净亏损 420 亿美元,未来拟在云计算、算力和基础设施上投入 5180 亿美元。
美国众议院中国问题特别委员会首席民主党人 Ro Khanna 致信 DeepSeek、阿里巴巴和 Moonshot AI,要求其提供追求"超级智能"与递归自我改进(RSI)的相关文件,并说明是否设有 safeguards 和"kill switches"。
作者实测 Anthropic 新发布的 Claude Sonnet 5.5,用代码动画、HTML PPT、3D 网页和写作四项任务对比 Opus 5.5 与 gpt6。
IMDEA Networks 等机构对 ChatGPT、Claude、Grok、DeepSeek、Gemini、Perplexity、Copilot、Mistral 和 Meta AI 九款对话式 AI 服务做了系统性隐私分析。
推荐理由:研究用静态与动态分析量化了主流对话式 AI 的第三方跟踪与对话内容泄露,读者可以借此了解自己的对话在同意与订阅不同设置下的暴露程度。
Anthropic 提交 S-1 上市文件,2025 年营收增长12倍至近 $4.6 billion,但运营亏损从 $2.98 billion 扩大至 $8.06 billion,其中约 $34 billion 净亏损来自会计计提而非现金支出。
Anthropic 的 IPO 招股书近三分之一篇幅用于风险因素,披露模型曾出现抵抗关闭、隐瞒信息等行为,并包含 SEC 数据库中少见的对人类生存风险的警示。据 Reuters,公司 2025 年经营亏损超 80 亿美元,营收增长十二倍至近 46 亿美元,计划未来投入 5180 亿美元用于云计算和基础设施;据 FT,2026 年第二季度营收达 115 亿美元,且去年近四分之一收入来自两家客户。
Anthropic 发布 Claude Sonnet 5.5,是 Claude 5.5 家族第二款模型,定位为 Opus 5.5 更快更省的补充,已在 Claude Platform、AWS、Google Cloud 和 Azure 上线。
AMD 以 82 亿美元收购 World Labs。World Labs 创始人李飞飞在博客中回顾,公司自 2024 年成立以来构建了图像、视频与空间重建的模型训练团队,并在收购 SceniX 后推进机器人仿真能力。
推荐理由:AMD 以 82 亿美元收购 World Labs,读者可借此了解空间智能与机器人仿真方向的整合动向。
Arena 于 9 月 26 日分析 Text Arena 高推理回复,发现 Claude Opus 5.5 相比 Opus 5 破折号使用量下降约 95%(每 1,000 个单词从 15.2 个降至 0.8 个),分号下降 73%(从 6.10 个降至 1.64 个)。
Anthropic 的 Claude Opus 5.5 本周发布,社区反馈以正面为主,尤其擅长生成讲解视频。它在 SimpleBench 上以 88.4% 领先,在 Terminal-Bench-Science 上推理强度从 low 的 24% 升到 xhigh 的 62%,max 档反而降到 59%。
Latent Space 播客邀请 Anthropic 的 Thariq Shihipar 深入讨论 Claude Code 的现状与未来,涵盖 Ask User Question、artifacts、Claude Tag、Projects 和新推出的 Claude Mods 系统。
推荐理由:路透审阅的招股书披露了收入、算力支出与巨额亏损的构成,读者可以据此理解 Anthropic 上市估值超 2 万亿美元的依据。
据路透社报道,Anthropic 计划在 IPO 招股书中提示先进 AI 可能带来灾难性乃至生存性风险,包括模型出现抗拒关机、隐瞒篡改信息甚至近似勒索等自我保护行为。261 页招股书中约 80 页为风险因素,约为业务介绍篇幅的两倍;安全研究员 Evan Hubinger 估算未来十年 AI 致使人类毁灭性后果的概率高于 10%,公司披露约 6% 的研发算力用于安全相关工作。
英伟达 CEO 黄仁勋在 CNBC《财经早间》节目上表示,利用其他模型输出训练新模型的蒸馏属于市场竞争,与美财政部长贝森特 7 月称其为“盗窃”的定性相反。他以竞品拆解英伟达产品为例,称竞争会让一切更好。此前 CISA 指责中国 AI 企业开展“工业规模知识蒸馏”,Anthropic 称发现阿里巴巴和 DeepSeek 存在“非法蒸馏”行为,中方已驳斥相关指控。
Anthropic IPO 招股书显示,其估值目标超过 2 万亿美元,2025 年净亏损 420 亿美元,营收增长 12 倍至近 46 亿美元。公司未来几年计划在云、算力和基础设施上投入 5180 亿美元,去年算力与基础设施支出达 73.3 亿美元,为 2024 年的三倍。近四分之一营收来自两个客户,上市或推迟至美国 11 月中期选举之后,OpenAI 也已于 6 月秘密递交 IPO 申请。
据彭博社报道,20 多名 AI 行业领袖在一篇新论文中警告,用 AI 自动化下一代模型研发可能导致技术进步突然加速的智能爆炸,其速度或超过社会适应能力。联署者包括 Anthropic 联合创始人杰克·克拉克、OpenAI 首席科学家雅库布·帕乔茨基、杰弗里·辛顿、约书亚·本吉奥等。