AI@NEWS

DeepSeek押注华为芯片训练超大模型

据报道其正训练2万亿参数模型,并计划以国产芯片推进8万亿参数模型。

推荐理由:从2万亿扩至8万亿参数会把国产训练集群的互联、内存和良率推至极限;“必须成功”反映出口管制正迫使算法与硬件协同迁移。

阅读原文