跳到正文
原文
HuggingFace Daily Papers(社区热门论文)·· 24 天前AI 评分61

Elo-per-token 分析揭示 LLM Agent 测试时算力策略的收益递减

When Agents Slow Down: Understanding LLM Agents' Test-Time Strategies via Elo-per-token Analysis

AI 导读

论文提出 Elo-per-token 分析方法,用 Bradley-Terry 模型将任务内排序聚合为跨任务 Elo 评分,衡量 LLM Agent 测试时算力策略的扩展规律。

整理与数据来源:AIHOT

来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org