双R9700运行量化Qwen达百Token每秒
R9V更新修复SSD流式推理崩溃,IQ4_XS生成约100 tok/s,并新增Q4_K_XL支持。
推荐理由:双R9700加128GB内存运行Qwen量化模型已达约100 tok/s,且SSD流式方案通过12小时稳定性测试;这表明消费级RDNA4多卡正逼近高吞吐本地推理实用线。
R9V更新修复SSD流式推理崩溃,IQ4_XS生成约100 tok/s,并新增Q4_K_XL支持。
推荐理由:双R9700加128GB内存运行Qwen量化模型已达约100 tok/s,且SSD流式方案通过12小时稳定性测试;这表明消费级RDNA4多卡正逼近高吞吐本地推理实用线。