Ember-1声称在不降低任务表现的情况下,将推理轨迹所用令牌减少40%。
推荐理由:若评测成立,40%的推理令牌削减会直接改善延迟、吞吐和成本,说明开放模型仍有显著推理效率空间;但正文未给基准与复现细节。
阅读原文