Nex N2.5 Mini在M5 Max达133.6 tok/s
Nex N2.5 Mini的4位MLX量化版在苹果M5 Max上实现133.6 tok/s,兼顾生成质量与内存占用。
推荐理由:4位量化模型在M5 Max上生成达133.6 tok/s,且提示处理、质量与内存表现均衡,说明消费级苹果设备已能承载高吞吐本地智能体与轻量编码任务。
Nex N2.5 Mini的4位MLX量化版在苹果M5 Max上实现133.6 tok/s,兼顾生成质量与内存占用。
推荐理由:4位量化模型在M5 Max上生成达133.6 tok/s,且提示处理、质量与内存表现均衡,说明消费级苹果设备已能承载高吞吐本地智能体与轻量编码任务。