SD200 Ultra单机可运行2.8万亿参数模型,Token生成时延降至5.85毫秒。
推荐理由:单机以本土芯片承载2.8万亿参数模型,并将Token生成时延压至5.85毫秒;若能规模化交付,将验证国产超节点的大模型推理能力。
阅读原文