AI@NEWS
多模态安全神经元干预
SafeNexus发现并操控MLLM中的跨模态安全神经元。
推荐理由:
安全对齐从提示和解码转向神经元级干预,若跨文本、图像等模态共享成立,说明MLLM安全机制存在可定位的内部控制点。
阅读原文