观点 / 方法普通
Unsloth 发布免费 notebook,可将 Qwen3.5-4B 本地训练成决策模型
原始标题:You can now train your own Decision model with our free notebook! 💡
内容摘要
Unsloth 发布免费 notebook,教用户把 Qwen3.5-4B 训练成生成决策而非文本的决策模型,本地仅需 8GB VRAM。内容涵盖数据准备(state、questions、gold answers)、训练与服务;配套指南见 unsloth.ai/docs。其引用帖提到用 Clef head 加 LoRA(r=64)微调一 epoch,把 Qwen3.5 0.8B 在 3 个决策基准上的总体准确率从 20.7% 提到 74.3%,仅需 4GB VRAM。Notebook:https://colab.research.google.com/github/unslothai/notebooks/blob/main/nb/Qwen3_5_(4B)-Decision.ipynb
内容分类AI 观点与方法
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Unsloth (@UnslothAI)
站内情报编号intel-075febe9fe43319988f91439