跳到正文
原文
Simon Willison 博客· Simon Willison·· 2026-09-02AI 评分70

Simon Willison 用 pelican 基准实测 Claude Fable 5.1 的五个推理档位

Claude Fable 5.1 made me a really nice animated pelican

AI 导读

Simon Willison 实测 Claude Fable 5.1 在 pelican 基准上的表现。Anthropic 称该模型在 Terminal-Bench-Science 0.1 上得 52.6%,高于 Fable 5 的 24.7%。

整理与数据来源:AIHOT

来源:Simon Willison 博客 · simonwillison.net