Qwen3.5 4B微调复现Jev能力
开发者用2500万合成词元和单张RTX 3090训练两小时,将typed-decisions得分从0.596提升至0.709。
推荐理由:低成本LoRA微调带来约19%的相对增益,且数据集与兼容接口均已开源,说明小模型可借助高质量合成数据快速获得特定决策能力。
开发者用2500万合成词元和单张RTX 3090训练两小时,将typed-decisions得分从0.596提升至0.709。
推荐理由:低成本LoRA微调带来约19%的相对增益,且数据集与兼容接口均已开源,说明小模型可借助高质量合成数据快速获得特定决策能力。