AI@NEWS
BLINDSPOT:长程智能体安全校准基准
以完整交互轨迹评估工具智能体何时行动、拒绝或随授权变化调整行为。
推荐理由:
核心突破是把安全评估从任务成败提升到轨迹级校准,能暴露多轮工具调用、状态持久化和授权变化后才出现的隐性风险。
阅读原文