Artificial Analysis· @ArtificialAnlys · X·· 2026-09-08AI 评分44
AI 导读
Artificial Analysis 发布智能指数 v4.3,将 Terminal-Bench 升级至 4.0,并新增基于 Zapier 私有测试集的智能体工作流基准 AutomationBench-AA。Claude Fable 5.1 与 GPT-6 Astra 以 53 分并列领先,GLM-5.3 与 Kimi K3 以 44 分领跑开源模型。私有任务评测权重由 40% 提升至 45%。
整理与数据来源:AIHOT
来源:Artificial Analysis · x.com