用 Unsloth 微调 Gemma-3-4B 生成合成数据
文章用 Unsloth + QLoRA 把 Gemma-3-4B 微调成按格式产出(问题, 推理, 答案)三元组的合成数据生成器,全程单卡 24GB 可跑,并给出可直接复制的训练与生成脚本。
文章用 Unsloth + QLoRA 把 Gemma-3-4B 微调成按格式产出(问题, 推理, 答案)三元组的合成数据生成器,全程单卡 24GB 可跑,并给出可直接复制的训练与生成脚本。
Aleph Alpha 发布德英双语模型 Kolibri,总参数 78B,采用混合专家架构,每个 token 约激活 3B 参数。