AI@NEWS

Dream-RSI将智能体探索成本降至1/162

DeepMind用历史轨迹模拟离线搜索,仅优化探索策略而不修改模型权重。

推荐理由:Dream-RSI把真实执行轨迹变成可复用模拟环境,先离线筛选策略再上线验证,最高降低162倍探索成本,为代码智能体和自动科研提供可控自改路径。

阅读原文