跳到正文
原文
elvis· @omarsar0 · X·· 14 天前AI 评分44
AI 导读

Pareto 26.9 通过将请求分发至多个前沿与开源模型并保留最佳答案,在 30 项智能体任务评测中与 GPT-6 Astra 并列第一,每成功任务成本约为后者 1/3,且完成任务速度快于 DeepSeek V4 Pro 和 GLM 5.3 Flash。同一评测中,GPT-6 Sol 得分追平 Opus 5.5,速度更快,每成功任务成本约为其 1/4。

整理与数据来源:AIHOT

来源:elvis · x.com