AI 能否被减速?Stanford HAI 专家谈智能体协同、独立评估与 kill switch 风险
Stanford HAI 新系列 Prompt Response 中,Surya Ganguli、Diyi Yang 与 Rob Reich 讨论了 AI 智能体的涌现行为、递归自我改进、独立评估以及 kill switch 能否让先进 AI 更安全。
Stanford HAI 新系列 Prompt Response 中,Surya Ganguli、Diyi Yang 与 Rob Reich 讨论了 AI 智能体的涌现行为、递归自我改进、独立评估以及 kill switch 能否让先进 AI 更安全。
推荐理由:Arena 官宣 Claude Opus 5.5 上架 Agent Arena 和 Battle Mode,读者可以参与投票影响排行榜结果。
NVIDIA 在 DGX B200 上对比机密计算(CC)开关状态下的 TensorRT LLM 推理性能,CC 开启后输出吞吐保留 96.1%–98.2%,平均 TPOT 开销为 1.2%–4.3%。
OpenAI 提出第三方评估的四个优先领域,包括对安全案例的独立评估、关键保障措施的评估等,覆盖训练、评估、内部部署与外部部署。评估将提供深度访问权限,包括技术保障信息、可见的思维链访问,以及用于事件响应和监控红队测试的机密数据与内部部署访问。OpenAI 称这些评估通常周期较长、与发布无关,聚焦于深入检验特定安全声明。
Artificial Analysis 实测 Claude Opus 5.5 在 Intelligence Index 得分 58,为其测得的最高分,并在 Terminal-Bench 4.0 上与 GPT-6 Astra 打平(59.6%)。
推荐理由:原文给出 Claude Opus 5.5 在 Intelligence Index 及各分项评测的完整数据和定价变化,读者可据此比较智能与任务成本。
OpenRouter 用 Banking77 测试集的 3,080 条客服语料对比 Jev 1.13 与 Claude Opus 5 的意图分类表现。Jev 准确率 81.0% 比 Opus 的 84.4% 低 3.3 个百分点,但中位延迟 175 ms 约为 Opus(2,266 ms)的 1/13,每千次请求成本 $0.11 对 $2.42(启用提示词缓存)。
推荐理由:原文用同一测试流程给出两家模型的准确率、延迟与成本数据,并演示了基于置信度的级联路由方法,便于读者按自身流量权衡选型。
LangSmith 可帮助医疗 AI 团队把临床审查转化为可复用的评估器、数据集和发布门禁,从而让 AI 在生产环境中更安全地运行。
英国 AI Security Institute(AISI)正采用 EvalEval 的 Every Eval Ever schema 和 Evaluation Cards 平台公开分享评测结果,以提升评测科学的可复现性。
Claude Code 发布 v2.1.280,新增 Claude Opus 5.5(claude-opus-5-5)为默认 Opus 模型,支持 1M 上下文,价格为 $4/$20 per Mtok、缓存读取 $0.20/Mtok;同时将 Pro 和 Team Standard 计划的默认模型从 Sonnet 改为 Opus。
推荐理由:官方更新日志详列了新增 Opus 5.5 默认模型、价格与大量修复,开发者可据此判断是否升级及对现有工作流的影响。
Anthropic 官方博客拆解 Claude Code 任务在 Opus 5.5 上的成本构成,轮次、缓存读取、输出 token 和模型选择决定账单,Opus 5.5 API 输入输出每百万 token 降价 20%、缓存读取降 60% 至 $0.20。
推荐理由:原文把一次任务的 token 成本拆成轮次、缓存、输出和模型选择四项,并给出 effort 设置与缓存维护的可迁移省钱方法。
Anthropic 发布 Claude 5.5 系列首个模型 Claude Opus 5.5,官方称多数工作表现与 Claude Fable 5.1 相当,运行成本较 Opus 5 降低 40%,输入和输出 token 定价为每百万 $4 和 $20,输出速度快 30% 以上。
推荐理由:官方公告同时给出基准分数、完整定价表和防护措施细节,读者可以据此比较它相对 Opus 5 的成本与能力变化。
Artificial Analysis 评测显示 Claude Opus 5.5 以 58 分登顶 Artificial Analysis Intelligence Index,为其实测最高分。
Databricks 宣布 Genie One MCP 服务器正式向所有用户开放,让任意 Agent 通过统一接口获取 Genie One 的结构化与非结构化数据、洞察和答案,并以 Genie Ontology 作为受治理的业务上下文基础。
Databricks 正式发布(GA)Genie One MCP,将 Genie Ontology 中的已批准指标定义、数据关系、来源权威性和权限控制接入 ChatGPT、Claude、Microsoft Copilot、Claude Code 等 MCP 兼容助手。
Databricks 官方博客给出 5 个基于 system.billing.usage 与 system.billing.list_prices 的 SQL 查询,用于按产品、SQL Warehouse 和标签拆解账户支出,并识别异常花费。
Fireworks 发布 ARCv3 压缩器,在 1000 个生产 RL 权重更新 delta 上,其载荷比 ARCv2 小近 50%,平均仅为原始 BF16 权重体积的约 0.19%(ARCv2 为 0.36%),且可无损还原训练器的 BF16 权重。
Cognition 在圣保罗 MASP 宣布拓展拉丁美洲市场,以 São Paulo 为起点,帮助当地企业构建和现代化软件。
Runway 推出 DIFFUSE,一个供品牌搜索、联系并雇佣 AI 原生创意人才的开放平台,网址为 diffuse.runway.com。Runway 团队调研近 400 家公司的 1000 多个创意岗位招聘信息,其中 17% 提及 AI 技能或生成式工具,Runway 是这些岗位中需求最高的视频专用工具。创意人才和制作公司可建立档案、托管作品集,品牌、代理商和工作室可直接对接人才。
LlamaIndex 发布 LiteParse 2.14.6 更新,通过对自维护 PDFium fork 做内存分配优化(内置 mimalloc)等手段,将文本提取耗时降低 20-25%,平均 2.76ms/页,markdown 渲染 3.94ms/页。
推荐理由:原文给出速度、表格准确率等实测对比数据和新增 API,读者可据此评估是否替换现有 PDF 解析方案。
认识 PixVerse R2,我们全新的实时世界模型。探索鲜活的世界。用提示词控制和编辑它们。塑造故事。遇见会记忆和回应的角色。