AI@NEWS

Qwen3.5 4B微调复现Jev能力

开发者用2500万合成词元和单张RTX 3090训练两小时,将typed-decisions得分从0.596提升至0.709。

推荐理由:低成本LoRA微调带来约19%的相对增益,且数据集与兼容接口均已开源,说明小模型可借助高质量合成数据快速获得特定决策能力。

阅读原文