论文 信源:Epoch AI:研究、数据与评测 · 👁️ 20632 次研读

ExploitBench v0.1:评估 LLM 智能体利用真实软件漏洞的渐进能力

ExploitBench v0.1:评估 LLM 智能体利用真实软件漏洞的渐进能力
💡 灵机 AI 深度洞见与核心提炼
卡内基梅隆大学研究者创建的 ExploitBench 评测 LLM 智能体利用真实软件漏洞的渐进能力,评分从到达漏洞代码、触发崩溃、构建利用原语到完全任意代码执行分层,而非二元的成败判定。
信源媒体:Epoch AI:研究、数据与评测
访问出处网页 ↗
阅读原文出处 ↗