论文 信源:Dwarkesh Patel:Podcast & Blog(RSS) · 👁️ 33079 次研读

Dwarkesh Patel 研究:预训练进步主要来自数据改进

💡 灵机 AI 深度洞见与核心提炼
Dwarkesh Patel 发布实验分析,在最高 1e19 FLOPs 的算力预算下训练 2019 至 2025 年各年度代表性模型配方与数据语料,发现数据改进带来 12.0x 算力效率提升,模型改进为 3.7x,数据贡献约为模型的 3.24 倍。
信源媒体:Dwarkesh Patel:Podcast & Blog(RSS)
访问出处网页 ↗
阅读原文出处 ↗