信源:X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf) · 👁️ 25738 次研读

TRL v1.13 发布:长上下文训练

💡 灵机 AI 深度洞见与核心提炼
TRL v1.13 发布!我们的开源 RL 训练库,用于对基础模型进行后训练 本次新版本聚焦"长上下文训练",新增了一份关于如何用 1M+ token 上下文对模型进行后训练的指南 https://huggingface.co/docs/trl/long_context_training ,以及一如既往的速度和内存使用方面的多项改进 详见 https://github.com/huggingface/trl
信源媒体:X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf)
访问出处网页 ↗
阅读原文出处 ↗