AI@NEWS

WinterMix发布MLX量化版Qwen3.5

作者发布Qwen3.5-122B-A10B原生MLX量化权重,82GiB版本实测优于更大6-bit量化。

推荐理由:核心信息不是新模型,而是Apple Silicon本地部署效率改进:82GiB MLX量化在单台128GB M5 Max上接近源GGUF精度,同时换来显著更快prefill,降低大模型本地推理门槛。

阅读原文