AI@NEWS

Jev为Codex动态调节推理深度

该方案按任务进展实时分配推理算力,声称在保留缓存下提速并降低约50%成本。

推荐理由:价值在于把模型选择改成执行期的推理预算控制:顺畅步骤降档、受阻时升档,理论上比固定档位更省算力;五成降本仍需复现实验。

阅读原文