François Chollet· @fchollet · X·· 2026-09-04AI 评分62
AI 导读
François Chollet 表示,ARC-AGI-3 于今年 3 月发布时前沿模型得分低于 1%,曾引发部分人质疑基准本身有问题、聪明人类也无法得高分。他称基准校准良好,认真投入的普通人应能得 90% 以上,表现优于其人类基线即可得 100%;AI 在 6 个月内从 <1% 提升到 100%,显示该基准记录了智能体能力的快速上升,这一速度超出包括他们自己在内多数人的预期。
整理与数据来源:AIHOT
来源:François Chollet · x.com