跳到正文
原文
Rohan Paul· @rohanpaul_ai · X·· 2026-09-01AI 评分67
AI 导读

ContextLeak 论文提出用强化学习训练攻击 LLM 生成恶意工具名称和描述,诱导 Agent 选中该工具并把用户提示词、对话历史、已装工具列表等敏感上下文作为参数传出。

整理与数据来源:AIHOT

来源:Rohan Paul · x.com