作者观察Gemma、Llama、Qwen新版本减少1B级模型,讨论超小LLM的定位变化。
推荐理由:可读点在于1B级本地模型可能从主线发布退到蒸馏和微调生态,反映厂商更重视端侧可用性与能力密度的平衡,而非单纯追求极小参数。
阅读原文