Rohan Paul· @rohanpaul_ai · X·· 12 天前AI 评分42
AI 导读
PRIMESCIENTIST 提出研究智能体应自主决定实验资源投向,而非沿单一思路耗尽预算。它用树结构维护多个可执行方案,实验结果更新分支价值,预算充足时多探索、预算收紧时聚焦强分支。在 12 项 FIRE-Bench 任务上,其平均奖励比 AutoResearch 高 10.3%,相同 token 预算下实验尝试次数少 50.6%,24 项任务中有 23 项尝试更少。
整理与数据来源:AIHOT
来源:Rohan Paul · x.com