HuggingFace Daily Papers(社区热门论文)·· 2026-09-01AI 评分38
CoGR:用强化学习共同进化查询与物品两侧的生成式检索器
It Takes Two to Match: Co-Evolving Generative Retriever with Reinforcement Learning
AI 导读
论文提出 CoGR 检索框架,训练 LLM 直接在查询侧和物品侧生成紧凑关键词集,经倒排索引直接匹配,兼容现有关键词检索基础设施。训练采用两阶段流程,先用监督微调对齐关键词空间,再用 GRPO 交替优化两侧生成器,双方共同优化同一 query-to-item 检索 F_1 目标。
整理与数据来源:AIHOT
来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org