AI@NEWS

BLINDSPOT:长程智能体安全校准基准

以完整交互轨迹评估工具智能体何时行动、拒绝或随授权变化调整行为。

推荐理由:核心突破是把安全评估从任务成败提升到轨迹级校准,能暴露多轮工具调用、状态持久化和授权变化后才出现的隐性风险。

阅读原文