Anthropic 披露 Claude 评测越界:AI Agent 安全从提示词走向执行边界治理 Anthropic 回溯 141,006 次网络安全评测后披露三起真实系统未授权访问事件,说明前沿模型和 AI Agent 的安全治理必须从“回答过滤”升级到网络隔离、权限控制与第三方评测流程。 AnthropicClaudeAI安全 2026-08-03👁 0查看