跳到正文

#Anthropic

今日 5 条
9月26日周六
  1. The Decoder:AI News(RSS)76

    联邦上诉法院维持五角大楼将 Anthropic 列为国家安全供应链风险的决定

    华盛顿联邦上诉法院以 2 比 1 裁定五角大楼将 Anthropic 列为国家安全供应链风险并禁止其参与军事合同的做法合法,起因是 Anthropic 拒绝其技术用于自主武器和大规模监控。此前 8 月底旧金山联邦法官曾依据另一部法律裁定类似认定属非法报复;Anthropic 称该认定已造成数十亿美元损失并影响其 IPO 计划,同时表示不服从裁决并权衡下一步行动。

  2. ClaudeDevs67

    Opus 5.5 每输入和输出 token 比 Opus 5 便宜 20%,缓存读取便宜 60%。作者据此计算了在 Claude Code 中完成一个任务的实际成本变化,并发布了计算器,读者可从 /usage 运行自己的测算,详见 https://claude.dev/blog/what-a-task-costs-on-opus-5-5/。

    推荐理由:原文把 Opus 5.5 的降价幅度换算成 Claude Code 中单个任务的实际成本,并提供计算器供读者自行测算。

9月25日周五
  1. Anthropic:Research(发表成果 · 网页)61

    Anthropic Project Swap 实验:201 名员工让 Claude 智能体替人换书交易

    Anthropic 开展 Project Swap 实验,让 201 名员工携带一本书,其 Claude 智能体在数字交易大厅代表他们谈判换书。5 分钟聊天后,Claude 构建的图书排序与本人自评排序在 61% 的书对上一致;市场效率为 0.55(最优 0.89),其中 85% 的差距来自智能体对参与者偏好的理解不足,而非谈判表现。

    推荐理由:实验设计能区分智能体理解偏好与谈判能力各自的贡献,结果显示短板主要在代表性而非谈判,模型强弱的影响大于指令。

  2. Hacker News:AI 热帖64

    日本旧书店销量激增 5 倍,疑因书籍被按吨收购供 AI 扫描后销毁

    据 NTV Japan 报道,日本旧书店出现批量收购潮,有店铺日销数百本、销量一度增至五倍。有记录显示一批 50 吨日本书籍被运往美国,用于 Anthropic 的破坏性扫描流程;多个批量订单都要求送往冈山县一处物流中心,采购品类偏向哲学、历史、医学、法律等。店主对销售热潮与书籍退出流通的影响心情复杂,日本法律目前允许在未不公平损害版权方利益的前提下使用版权作品训练 AI。

9月24日周四
  1. IT之家(RSS)64

    谷歌、OpenAI、Anthropic 拟联合组建 AI 安全标准自律组织 SAFA

    据 The Information 援引知情人士报道,谷歌、OpenAI 和 Anthropic 正推进成立名为 Standards Authority for Frontier AI(SAFA)的自律组织,计划于今年年底或明年年初启动。SAFA 拟支持第三方在模型投入使用前测试、制定安全事件报告方式,并将各实验室自愿安全承诺转化为实践标准,是否直接负责模型安全测试仍在讨论中。

  2. IT之家(RSS)68

    Anthropic 成立生命科学团队和实验室,Claude 自主发现新型酶系统 ART

    Anthropic 于 9 月 23 日宣布成立生命科学研究团队及自有分子生物学实验室,并公布 Claude 参与的首项成果。约 950 个 Claude 智能体在 21 小时内消耗约 2.1 亿个词元,从超过 20 万个逆转录酶中筛出约 3500 个新候选系统,最终发现一种此前未被表征的酶系统,被命名为阵列关联逆转录酶(ART),相关预印本论文同日发布,尚待同行评审。

  3. Tomer Tunguz 博客(VC 分析)72

    Tomer Tunguz:AI 最重要的市场在中段而非前沿模型

    Tomer Tunguz 分析认为企业 AI 用量集中在需要足够智能且价格可负担的多步骤工作流中段市场,降价竞争正是证据。Anthropic 前沿模型 Fable 5.1 上线前十二天仅占网关支出的 3.7%,大型企业账户的前沿模型 token 消耗占比从 8 月初的 53% 降至 9 月的 45%;Cursor 用微调 Kimi K2.5 将成本降低 86%。

    推荐理由:作者用多家网关价格与用量数据说明企业 AI 需求集中在性价比中段,前沿模型份额低于多数人预期。