Inkling-Small开源MoE模型发布
Thinking Machines发布276B MoE开源权重模型,每token仅激活12B参数。
推荐理由:12B激活量反超41B激活教师模型,说明蒸馏叠加短周期编码RL能显著压缩推理与代理编码成本,开源多模态智能体底座的性价比被重新抬高。
Thinking Machines发布276B MoE开源权重模型,每token仅激活12B参数。
推荐理由:12B激活量反超41B激活教师模型,说明蒸馏叠加短周期编码RL能显著压缩推理与代理编码成本,开源多模态智能体底座的性价比被重新抬高。