扎克伯格谈 AI 安全与对齐:Meta 曾为安全推迟数月发布 Muse
💡 灵机 AI 深度洞见与核心提炼
Mark Zuckerberg 发文回应关于在能力进展前放缓、等待对齐跟上的争论,认为信任与对齐正成为区分智能体和模型的最重要能力,不专注对齐的实验室会落后。他指出实验室因用户不信任失准智能体、模型致害需担责而有强激励做安全,并列举 Meta 的做法:曾为安全推迟数月发布 Muse、MSL 已在多个领域引入独立评估者、承诺将大部分算力用于服务用户而非追求递归自我改进。
信源媒体:X:Mark Zuckerberg (@finkd)
访问出处网页 ↗