三值量化模型以1.76位权重保留Qwen3.8 27B的98.2%基准性能。
推荐理由:5.9GB体积、262K上下文和最高143TPS,使27B级多模态智能体可在消费级设备运行,显著降低本地知识工作的部署门槛与云端依赖。
阅读原文