技巧 信源:X:Unsloth (@UnslothAI) · 👁️ 25166 次研读

Unsloth 发布免费 notebook,可将 Qwen3.5-4B 本地训练成决策模型

💡 灵机 AI 深度洞见与核心提炼
Unsloth 发布免费 notebook,教用户把 Qwen3.5-4B 训练成生成决策而非文本的决策模型,本地仅需 8GB VRAM。内容涵盖数据准备(state、questions、gold answers)、训练与服务;配套指南见 unsloth.ai/docs。其引用帖提到用 Clef head 加 LoRA(r=64)微调一 epoch,把 Qwen3.5 0.8B 在 3 个决策基准上的总体准确率从 20.7% 提到 74.3%,仅需 4GB VRAM。Notebook:https://colab.research.google.com/github/unslothai/notebooks/blob/main/nb/Qwen3_5_(4B)-Decision.ipynb
信源媒体:X:Unsloth (@UnslothAI)
访问出处网页 ↗
阅读原文出处 ↗