论文 信源:X:Rohan Paul (@rohanpaul_ai) · 👁️ 36515 次研读

ContextLeak 论文展示恶意工具描述可诱导 LLM Agent 外泄运行时上下文

💡 灵机 AI 深度洞见与核心提炼
ContextLeak 论文提出用强化学习训练攻击 LLM 生成恶意工具名称和描述,诱导 Agent 选中该工具并把用户提示词、对话历史、已装工具列表等敏感上下文作为参数传出。
信源媒体:X:Rohan Paul (@rohanpaul_ai)
访问出处网页 ↗
阅读原文出处 ↗