AI@NEWS

智谱上线GLM-5.3-FlashX

新模型API最高生成速度达每秒200 tokens,重点强化低延迟推理体验。

推荐理由:此次更新的实质是将输出速度推至最高每秒200 tokens,而非公布新的能力跃升;竞争焦点正从模型效果扩展到国产芯片规模化推理、延迟与单位调用成本。

阅读原文