M1 Ultra运行DeepSeek提速
补丁后M1 Ultra上DeepSeek V4量化推理从约5-6 tok/s升至15-16 tok/s。
推荐理由:同一M1 Ultra 128GB环境下吞吐约提升到原来的3倍,说明本地大模型性能瓶颈可能在推理引擎而非硬件;但样本单一,需复现实测确认。
补丁后M1 Ultra上DeepSeek V4量化推理从约5-6 tok/s升至15-16 tok/s。
推荐理由:同一M1 Ultra 128GB环境下吞吐约提升到原来的3倍,说明本地大模型性能瓶颈可能在推理引擎而非硬件;但样本单一,需复现实测确认。