论文 信源:Berkeley RDI:Blog(AI 安全与评测) · 👁️ 22835 次研读

UC Berkeley 团队用 AI Agent 审计 13 个基准,发现 45 个无需解题的满分作弊方案

💡 灵机 AI 深度洞见与核心提炼
UC Berkeley 团队构建全自动 AI Agent 审计 13 个广泛使用的基准,发现 45 个作弊方案,全部基准被评为 critical 风险,共归纳 16 种攻击类型。
信源媒体:Berkeley RDI:Blog(AI 安全与评测)
访问出处网页 ↗
阅读原文出处 ↗