IT早报 0929:央视起底“快应用”弹窗广告乱象;鸿蒙智行智界 RX 上市;荣耀 Magic9 系列发布;智谱 ZCode 删除涉事云端数据
Anthropic 发布 Claude Sonnet 5.5,速度较上一代提升 30%,智能体编码性能反超 Opus 5.5,网络攻防能力对标 Opus 5,并计划未来几周推出 Haiku 新版本。智谱 ZCode 宣布已删除涉事云端数据,后续做到“你不发起,不上云”,开源版本更新至 3.14.3,并向用户赠送多张重置卡和 1 亿 Token。
Anthropic 发布 Claude Sonnet 5.5,速度较上一代提升 30%,智能体编码性能反超 Opus 5.5,网络攻防能力对标 Opus 5,并计划未来几周推出 Haiku 新版本。智谱 ZCode 宣布已删除涉事云端数据,后续做到“你不发起,不上云”,开源版本更新至 3.14.3,并向用户赠送多张重置卡和 1 亿 Token。
据路透社看到的 Anthropic IPO 招股书,公司 2025 年净亏损 420 亿美元,营收增长 12 倍接近 46 亿美元,并计划未来一年投入 5,180 亿美元用于云服务与算力基础设施,上市后估值有望突破 2 万亿美元。
Simon Willison 发布 llm-anthropic 0.30,新增对 Claude Sonnet 5.5 的支持。该版本加入 llm anthropic refresh 命令,可直接从 Anthropic API 刷新模型列表,无需为新模型单独发版;同时新增 llm anthropic count 命令,调用免费 token 计数 API,在发送提示词前返回其将消耗的 token 数。
Anthropic 发布中端模型 Claude Sonnet 5.5,官方称速度比上一代提升 30%,Token 消耗速度明显更低,定位为编写代码和制作办公文档等日常任务的助手。
Anthropic 发布 Claude Sonnet 5.5,官方称其运行快 30% 以上,多数工作成本最多低 30%,定价与 Sonnet 5 相同但在各项基准上表现更好。
有观点认为,AI 实验室关于放缓前沿模型研发、重视安全的表态,主要是为了安抚依赖其推进 AGI 的员工。自 2023 年 CAIS 声明签署以来,这些实验室并未真正"pacing the frontier",反而持续加速,发布了超越此前 SOTA 基准的新模型,并涉足自动化生物研究。
Fireworks AI 发布 FireRouter with Opus,可在 Claude Opus 5.5、GLM 5.3 和 GLM 5.3 Flash 之间做缓存感知路由,并首次以独立路由模型形式作为 serverless 端点开放。
推荐理由:官方给出了内部 A/B 测试的成本与准确率数据,可帮助团队评估用缓存感知路由替代单一 Opus 的可行性。
Anthropic 与 NVIDIA 合作加强 Agent 安全。NVIDIA 发布 Open Agent Safety Platform,Anthropic 推出 Claude Managed Agents。
一组 Claude Sonnet 5.5 的早期实验。 @_re_pete 用 Sonnet 5 与 Sonnet 5.5 制作的秋叶模拟器对比。
GPU 租赁价格在九个月内从 $4.40 翻倍到 $8.08 每 GPU 小时,但 AI 使用价格仍在下降。
推荐理由:文章用 GPU 租金翻倍与 AI 推理降价并存的数据,解释两条曲线如何靠效率提升维持平衡,并指向每 GPU 小时毛利这一关键指标。
Anthropic 于今日发布 Sonnet 5.5,定位为比 Sonnet 5 更强的协作模型,但需要用户保持掌控并在适当时机调用 Opus。该模型是 Claude 拥挤家族中的新成员,具体参数与基准数据尚未披露。
Sonnet 5.5 已在 @conductor_build 上线! 我有种感觉 Opus 5.5 仍会是我的默认选择,但这张图表确实令人意外……
开发者用程序解释"月球明暗界线悖论":日落时太阳位于地平线以下,月亮被照亮部分本应朝下,但实际常朝上。原因是月亮升高后我们从下方观察,底部露出暗面,月亮越接近满月该现象越明显。作者称 Claude 和 Gemini 在调试中完全无法理解该问题,只会循环论证,认为这显示当前 AI 缺乏推理能力。
Claude Sonnet 5.5 现已在 Google Cloud 上线,面向编程与知识工作场景。官方称其能以更低单任务成本、更快速度帮助构建功能并产出规范的工作材料。
20 多位 AI 研究者在论文中警告,自我改进的 AI 可能引发智能爆炸,签署者包括 Geoffrey Hinton、Yoshua Bengio 和 OpenAI 研究负责人 Jakub Pachocki。
The Verge 报道 AI 智能体正在放大黑客攻击能力,小型医院、银行和非营利组织难以招架。Anthropic 曾披露一个网络犯罪团伙用 Claude Code 在一个月内勒索医疗机构。
Artificial Analysis 发布对 Claude Sonnet 5.5 的评测:其智能指数得分 56,max effort 下比 Sonnet 5 高 18 分,升至第 2 名,仅落后 Opus 5.5 (max)。
推荐理由:Artificial Analysis 实测指出 Sonnet 5.5 逼近 Opus 5.5 依赖约 193k 输出 token,成本细节对选型有直接参考价值。
Anthropic 的 Claude Sonnet 5.5 上线 OpenRouter。原文称其明显比 Sonnet 5 更聪明、写作更清晰,且对多数工作负载快约 30%、便宜约 30%。
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上线,定位为面向编码与知识工作的更高效 Sonnet 模型,多数任务单任务成本更低、速度更快。
推荐理由:AWS 官方给出 Sonnet 5.5 的定位、与 Opus 5.5 的分工以及 Bedrock 上的调用方式,便于判断何时选用。
Claude Code v2.1.284 将 Anthropic API 上的默认 Sonnet 模型升级为 Claude Sonnet 5.5(claude-sonnet-5-5),支持 1M 上下文,定价 $2/$10 per Mtok、缓存读取 $0.20/Mtok。
Anthropic 发布 Claude Sonnet 5.5,输出速度提升超过 30%,因每任务消耗 token 更少,有效成本最多降低 30%,多项基准接近 Opus 5.5。
推荐理由:Arena 介绍了其 Agent Arena 的评测方式,读者可以据此理解 Claude Sonnet 5.5 在真实智能体任务上的衡量口径。
推荐理由:Artificial Analysis 用自家基准拆解了性能与 token 成本的权衡,为选型提供了可对比的量化参考。
Anthropic 发布 Claude Sonnet 5.5,称为 Claude 5.5 家族的第二款模型,相比 Sonnet 5 是明显升级,运行速度提升超过 30%,多数工作成本最多降低 30%。
Anthropic 发布中端模型 Sonnet 5.5,官方称其比前代 Sonnet 5 快 30%,token 消耗明显更低。公司基准显示该模型在 agentic 编码上优于 Opus 5.5,并称其具备与 Opus 5 相当的网络安全能力,因此成为首个适用与 Fable 和 Opus 相同网络安全防护的 Sonnet 模型;公司还计划在未来几周发布新版本 Haiku。