AI@NEWS

Naive发布309B混合注意力模型

Naive-N0.5-Flash面向编程与AI研发,支持百万上下文及混合SWA/DSA架构。

推荐理由:模型以3090亿总参数、155亿激活参数承载百万上下文,并混合SWA与DSA;核心看点是用稀疏激活控制长上下文推理成本,但性能尚待基准验证。

阅读原文