AI@NEWS

浪潮发布国产芯片超节点AI服务器

SD200 Ultra单机可运行2.8万亿参数模型,Token生成时延降至5.85毫秒。

推荐理由:单机以本土芯片承载2.8万亿参数模型,并将Token生成时延压至5.85毫秒;若能规模化交付,将验证国产超节点的大模型推理能力。

阅读原文