Anthropic 은 Opus 5 가 브라우저 환경에서 프롬프트 인젝션 공격에 거의 면역이라고 밝혔다.
7x24h 속보
Anthropic 은 Opus 5 가 브라우저 환경에서 프롬프트 인젝션 공격에 거의 면역이라고 밝혔다.
Anthropic 은 브라우저 에이전트 시나리오에서 자사의 Opus 5 모델이 프롬프트 인젝션 공격에 거의 면역이라고 발표했습니다. 129 개 테스트 시나리오에서 공격 성공률은 0 이었으며, Gray Swan 일반 프롬프트 인젝션 테스트에서는 15 번 시도 후 성공률이 Opus 4.8 의 5.5% 에서 2.0% 로 하락했습니다. 0 성공률은 Claude Cowork 등 제품에서 Auto Mode 를 활성화했을 때만 달성되었으며, 이 모드는 입력 스캔과 실행 차단이라는 이중 방어 계층을 적용했습니다. 프롬프트 인젝션은 AI 에이전트가 직면한 최대 보안 위험 중 하나로 간주되며, 이번 개선은 특정 시나리오에서 해당 문제가 효과적으로 완화되었음을 나타낼 수 있습니다.
TechFlow 소식에 따르면, 7 월 25 일, Anthropic 은 자사 Opus 5 모델이 브라우저 에이전트 시나리오에서 프롬프트 인젝션 공격에 거의 면역이라고 발표했습니다. 129 개의 테스트 시나리오에서 공격 성공률은 0% 였으며, Gray Swan 일반 프롬프트 인젝션 테스트에서는 15 번 시도 후 성공률이 Opus 4.8 의 5.5% 에서 2.0% 로 하락했습니다. 0% 의 성공률은 Claude Cowork 등 제품에서 Auto Mode 를 활성화했을 때만 달성되었으며, 해당 모드는 입력 스캔과 실행 차단이라는 두 계층의 방어를 적용했습니다. 프롬프트 인젝션은 AI 에이전트가 직면한 최대 보안 위협 중 하나로 간주되며, 이번 개선은 특정 시나리오에서 해당 문제가 효과적으로 완화되었음을 나타낼 수 있습니다.




