Adversarial NLI:面向 NLI 系统的人类对抗压力测试数据集
💡 灵机 AI 深度洞见与核心提炼
Adversarial NLI(ANLI)通过人类与模型在环流程构建,标注者专门编写能骗过强 NLI 系统的前提-假设对。相比早期 NLI 数据集,ANLI 包含更难、更多样的语言现象和更少的表层模式,成为对蕴含、矛盾与中立判断的鲁棒压力测试。其性能通常按逐步加难的轮次报告,反映对抗压力递增与分布外泛化能力。
信源媒体:Epoch AI:研究、数据与评测
访问出处网页 ↗