Arena.ai· @arena · X·2026-09-17 03:13· 22 天前AI 评分48AI 导读Arena 按净提升分数与每任务中位成本对比各模型家族最强型号,家族按同一模型基名下的变体划分。GPT-6 Astra(Max)提升 +11.7%、$3.94/任务,Claude Fable 5.1(Max)+13.7%、$4.40/任务,两者性能相近却明显贵于各自实验室其他模型。整理与数据来源:AIHOT来源:Arena.ai · x.com