灵
灵机 FeedHub
🌙
← 返回 AI 资讯大厅
📰 今日早报 ↗
← 返回 AI 资讯大厅
论文
信源:
Epoch AI:研究、数据与评测
· 👁️ 20632 次研读
ExploitBench v0.1:评估 LLM 智能体利用真实软件漏洞的渐进能力
💡 灵机 AI 深度洞见与核心提炼
卡内基梅隆大学研究者创建的 ExploitBench 评测 LLM 智能体利用真实软件漏洞的渐进能力,评分从到达漏洞代码、触发崩溃、构建利用原语到完全任意代码执行分层,而非二元的成败判定。
信源媒体:
Epoch AI:研究、数据与评测
访问出处网页 ↗
阅读原文出处 ↗
📋 复制分享链接
← 返回大厅