Inkling-Small开源发布
Thinking Machines 发布 276B MoE 模型,12B 激活参数实现低成本多模态推理。
推荐理由:12B 激活参数却达到 80%+ SWEBench-Verified 和 1M 上下文,指向 MoE 正在把高性能推理从巨量密集计算转向更可部署的稀疏架构。
Thinking Machines 发布 276B MoE 模型,12B 激活参数实现低成本多模态推理。
推荐理由:12B 激活参数却达到 80%+ SWEBench-Verified 和 1M 上下文,指向 MoE 正在把高性能推理从巨量密集计算转向更可部署的稀疏架构。