两个AI代理用6天和3000美元完成论文但均被拒,短板不是执行而是研究判断。
推荐理由:实验显示当前代理已能独立跑实验、调GPU和写论文,但会把负面评审转化为缩小表述而非重设问题,说明开放式科研瓶颈在选题与实验判断。
阅读原文