AI@NEWS

Astra模拟结果流畅但缺少探索感

作者称Astra实际运行了模拟,但相比Fable较少表现出对结果的主动好奇。

推荐理由:观察触及智能体体验的重要差异:正确执行模拟不等于主动追问异常结果;不过帖子缺少任务、输出和评价尺度,尚不能据此比较模型能力。

阅读原文