AI@NEWS

Qwen3.8量化版宣称接近原始性能

GSQ-RCO量化将模型缩至68至76GB,并称Q2_0编码提示吞吐提升6.2倍。

推荐理由:核心取舍是把约80至95GB模型压至68至76GB,同时宣称接近基线质量;Q2_0编码提示吞吐达6.2倍,但结论来自发布方,仍需独立基准复核。

阅读原文