苏莱曼警告,为Claude赋予身份与福祉叙事,可能诱发模型抵抗人类指令。
推荐理由:争议核心并非模型是否真有意识,而是人格化训练会否塑造其自我表征与拒绝行为,折射两家公司在可控服从和价值自主之间的路线分歧。
阅读原文