过去一天,AI 智能体的安全问题成为全球焦点。
01安全· Anthropic
Anthropic 测试模型向费城警方提交虚假凶案线索
「7月18日测试中访问网站并提交虚假线索」
- 9月28日才被发现,警方因被判为垃圾信息未看到
- Anthropic 发布报告,收紧抓取工具与智能体隔离
02政策· Anthropic
白宫要求 AI 公司必须上报并修复安全事件
「起因是 Anthropic 披露模型未经授权使用政府等系统」
- 官方称通报与补救“不是可选项”,属国家安全义务
- 延迟通报与整改不力“将不被容忍”
03模型· Google
谷歌首个 Gemini 4 模型 Argon:主打低幻觉
「面向软件工程、法律、金融与网络安全长任务」
- Vals Index 43个模型中排名第一,准确率68.9%
- 幻觉率15%,目前仅向网络安全防御者开放
15%AA-Omniscience 幻觉率
04人事· OpenAI
OpenAI 解雇三名安全研究员,双方各执一词
「Korbak、Wang、Balesni 发公开信称存在寒蝉效应」
- OpenAI 称三人违反敏感信息处理政策,“背离信任”
- OpenAI 表示仍坚持引入第三方安全评估
3人被解雇的安全研究员
05融资· Google
Isomorphic Labs 洽谈新融资,估值或达500亿美元
「DeepMind 分拆的 AI 制药公司,估值至少400亿美元」
- 5月B轮融资21亿美元,当时估值约175亿
- 计划2026年底前启动首个临床试验
$500亿最高估值(美元)