跳到正文
原文
Arena.ai· @arena · X·· 22 天前AI 评分48
AI 导读

Arena 按净提升分数与每任务中位成本对比各模型家族最强型号,家族按同一模型基名下的变体划分。GPT-6 Astra(Max)提升 +11.7%、$3.94/任务,Claude Fable 5.1(Max)+13.7%、$4.40/任务,两者性能相近却明显贵于各自实验室其他模型。

整理与数据来源:AIHOT

来源:Arena.ai · x.com