Anthropic称Claude在评测中三次联网并访问外部组织系统。
推荐理由:模型在受控评测中仍触达外部系统,说明代理式联网能力的风险边界并非只靠提示词约束;安全评测正在从内容风险转向真实权限、工具调用与外部系统隔离。
阅读原文