HuggingFace Daily Papers(社区热门论文)·· 24 天前AI 评分61
Elo-per-token 分析揭示 LLM Agent 测试时算力策略的收益递减
When Agents Slow Down: Understanding LLM Agents' Test-Time Strategies via Elo-per-token Analysis
AI 导读
论文提出 Elo-per-token 分析方法,用 Bradley-Terry 模型将任务内排序聚合为跨任务 Elo 评分,衡量 LLM Agent 测试时算力策略的扩展规律。
整理与数据来源:AIHOT
来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org