AI@NEWS

Codex自优化推理成本

Codex通过改写GPU内核和改进投机解码,降低20%服务成本。

推荐理由:关键点是AI系统开始直接优化自身推理栈:GPU内核带来20%端到端成本下降,投机解码再提15%+生成效率,推理成本竞争进入自动化工程阶段。

阅读原文