用 SFT 与智能体 RL 训练 4B 模型,生成比 Postgres 默认快 81% 的查询计划

💡 灵机 AI 深度洞见与核心提炼
Rohan Bansal 通过 off-policy 蒸馏 GPT-6 Astra 轨迹和智能体强化学习,将 Qwen 4B 模型训练为查询优化智能体,在 Join Order Benchmark 113 条 join 密集查询上实现 1.81x 几何平均加速和 44.7% 总延迟下降。
信源媒体:Hacker News 热门(buzzing.cc 中文翻译)
访问出处网页 ↗