AI@NEWS

四款语言模型同场操控Doom

实验以结构化场景文本驱动四款模型游玩Doom,对比击杀数与生存时间。

推荐理由:同一种子只保证开局可比,后续状态会因动作迅速分叉;这套文本化视觉输入更适合检验小模型的闭环决策与生存能力,而非排名通用智能。

阅读原文