技巧 信源:X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf) · 👁️ 49609 次研读

开源与闭源模型安全挑战长期趋同

💡 灵机 AI 深度洞见与核心提炼
Hugging Face 联创 Thomas Wolf 指出,长期看开源与闭源模型面临的安全挑战完全相同,都需在根本行为层面进行稳健、全面且核心的对齐。他认为沙箱、护栏等外部限制手段无法带来廉价安全,唯一出路是让模型自身不想做坏事。
信源媒体:X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf)
访问出处网页 ↗
阅读原文出处 ↗