DeepSeek V4 Flash跑上Strix Halo
开发者在Ryzen AI MAX+ 395上本地运行DeepSeek V4 Flash并达32 tok/s。
推荐理由:128GB统一内存让大模型加草稿模型能落在单颗APU上,32 tok/s超过同GPU既有18.99 tok/s记录,说明高端本地AI机器正逼近可用交互速度。
开发者在Ryzen AI MAX+ 395上本地运行DeepSeek V4 Flash并达32 tok/s。
推荐理由:128GB统一内存让大模型加草稿模型能落在单颗APU上,32 tok/s超过同GPU既有18.99 tok/s记录,说明高端本地AI机器正逼近可用交互速度。