AI@NEWS

DeepSeek V4 Flash混合AMD实测

用户在1张7900 XTX、3张MI60和128GB内存上跑出约11 tokens/s生成速度。

推荐理由:非标准AMD混卡仍能以量化模型跑到约11t/s,说明本地大模型推理的瓶颈正从能否运行转向显存拼接、带宽与上下文扩展效率。

阅读原文