OpenAI 发布模型对齐问题披露框架,并公开六份失当行为报告
💡 灵机 AI 深度洞见与核心提炼
OpenAI 发布追踪、调查和披露模型对齐问题的新框架,设定公开披露的标准和时间线,即使尚未完全解释或修复该行为也会公布。框架优先披露揭示新失当机制、已知问题显著变化或挑战现有安全假设的案例,并同步发布过去六个月训练或评估中观察到的六份失当行为报告,后续将根据公开反馈持续完善并发布更多报告。
信源媒体:X:Rohan Paul (@rohanpaul_ai)
访问出处网页 ↗