AI@NEWS

多模态安全神经元干预

SafeNexus发现并操控MLLM中的跨模态安全神经元。

推荐理由:安全对齐从提示和解码转向神经元级干预,若跨文本、图像等模态共享成立,说明MLLM安全机制存在可定位的内部控制点。

阅读原文