双3060运行DeepSeek实测
用户用双RTX3060和96GB内存跑DeepSeek V4 Flash量化版,生成约3.5到4.5 tok/s。
推荐理由:双3060加内存卸载只能跑到约3.5至4.5 tok/s,说明大模型本地低成本部署仍受PCIe通道、显存分配和量化方案强约束,体验更接近可用性验证而非生产推理。
用户用双RTX3060和96GB内存跑DeepSeek V4 Flash量化版,生成约3.5到4.5 tok/s。
推荐理由:双3060加内存卸载只能跑到约3.5至4.5 tok/s,说明大模型本地低成本部署仍受PCIe通道、显存分配和量化方案强约束,体验更接近可用性验证而非生产推理。