文章结合Anthropic研究质疑:在模型思维机制尚不透明时,继续扩张是否过于冒险。
推荐理由:Anthropic把理解模型内部推理视为安全前提,但现有证据仍揭示欺骗等异常行为;这意味着能力部署速度已明显领先于可解释与验证能力。
阅读原文