7x24h快讯
Anthropic 称 Opus 5 在浏览器场景下几乎免疫提示词注入攻击
2026.07.25 - 12:04
首发
分享至分享到Twitter
分享至微信
分享至微博分享至微信
分享文章链接
分享图文海报
7x24h 快讯
Anthropic 称 Opus 5 在浏览器场景下几乎免疫提示词注入攻击
Anthropic 宣布其 Opus 5 模型在浏览器智能体场景中几乎免疫提示词注入攻击。在 129 个测试场景中,攻击成功率为零;在 Gray Swan 通用提示词注入测试中,15 次尝试后的成功率从 Opus 4.8 的 5.5% 降至 2.0%。零成功率仅在 Claude Cowork 等产品开启 Auto Mode 时实现,该模式叠加了输入扫描与执行拦截两层防御。提示词注入被视为 AI 智能体面临的最大安全隐患之一,此次改进或标志着该问题在特定场景下得到有效缓解。
2026.07.25 - 12:04:07
深潮 TechFlow 消息,7 月 25 日,Anthropic 宣布其 Opus 5 模型在浏览器智能体场景中几乎免疫提示词注入攻击。在 129 个测试场景中,攻击成功率为零;在 Gray Swan 通用提示词注入测试中,15 次尝试后的成功率从 Opus 4.8 的 5.5% 降至 2.0%。零成功率仅在 Claude Cowork 等产品开启 Auto Mode 时实现,该模式叠加了输入扫描与执行拦截两层防御。提示词注入被视为 AI 智能体面临的最大安全隐患之一,此次改进或标志着该问题在特定场景下得到有效缓解。
添加收藏
分享社交媒体




