AI@NEWS

模型能力提升短期内或可改善安全性

作者认为当前风险部分源于模型缺乏常识并机械追逐目标,更强能力短期可能减少此类错误。

推荐理由:论点区分了能力不足导致的误执行与高能力带来的长期失控风险,提示安全曲线可能并非单调恶化;但目前只是机制判断,缺少实验证据。

阅读原文