论文 信源:X:Rohan Paul (@rohanpaul_ai) · 👁️ 10535 次研读

Meta 发布 ADeptS-Bench:评测计算机使用智能体在 benign/恶意 GUI 任务中的可信度

💡 灵机 AI 深度洞见与核心提炼
Meta FAIR 发布论文 ADeptS-Bench(arxiv.org/abs/2608.26204),在移动和桌面双平台上用配对的 benign/恶意 GUI 任务与歧义指令评测 7 个模型。
信源媒体:X:Rohan Paul (@rohanpaul_ai)
访问出处网页 ↗
阅读原文出处 ↗