GLM-5.3发布,强化学习推高安全能力
智谱发布GLM-5.3,同基座下靠后训练提升编程与漏洞利用链推理能力。
推荐理由:同一基座仅靠扩大RL后训练,Terminal Bench从4.6升至28.3,ExploitBench翻倍至54.4,说明长周期环境训练正在把开源模型推向可执行安全任务。
智谱发布GLM-5.3,同基座下靠后训练提升编程与漏洞利用链推理能力。
推荐理由:同一基座仅靠扩大RL后训练,Terminal Bench从4.6升至28.3,ExploitBench翻倍至54.4,说明长周期环境训练正在把开源模型推向可执行安全任务。