论文 信源:X:Rohan Paul (@rohanpaul_ai) · 👁️ 40956 次研读

自主智能体安全无法跨迭代组合

💡 灵机 AI 深度洞见与核心提炼
新论文《Safety Does Not Compose》指出,自主智能体若跨迭代记忆,其安全系统就不能在迭代间遗忘,长期任务安全无法简化为重复运行安全的短期轨迹。攻击者可将恶意证据分散在多个看似良性的步骤中,仅基于轨迹的监控器无法积累足够上下文识别攻击。论文地址:arxiv.org/abs/2608.27141。
信源媒体:X:Rohan Paul (@rohanpaul_ai)
访问出处网页 ↗
阅读原文出处 ↗