跳到正文
原文
Artificial Analysis· @ArtificialAnlys · X·· 16 天前AI 评分37
AI 导读

Grok 4.7 在 AA-Briefcase 上仅次于 Anthropic 模型,排名紧追 Opus 5,每任务成本约为其 50%。在 AA-Briefcase-Lite 尽调场景中,Grok 4.7 分析质量 Elo 从 Grok 4.6 的 1698 升至 1994,展示 Elo 则从 1531 微降至 1499。

整理与数据来源:AIHOT

来源:Artificial Analysis · x.com