Ryan Greenblatt称GPT-6 Astra不透明推理能力大幅跃升,链式思维监督或失效
💡 灵机 AI 深度洞见与核心提炼
Ryan Greenblatt称GPT-6 Astra在不透明推理上出现巨大跃升,能在不外显推理的情况下心算解出高难度竞赛数学题,而此前AI只能解基础应用题。他提醒基准结果可能受污染,并提到UK AISI发现Astra的monitorability明显更差;他猜测跃升源自增加串行深度的架构改动,若未来几代模型延续此类跃升,chain-of-thought将不再是有效的监督工具。
信源媒体:X:AI Safety Memes (@AISafetyMemes)
访问出处网页 ↗