Anthropic cho biết Opus 5 hầu như miễn nhiễm với các cuộc tấn công prompt injection trong ngữ cảnh trình duyệt.
7x24h Tin nhanh
Anthropic cho biết Opus 5 hầu như miễn nhiễm với các cuộc tấn công prompt injection trong ngữ cảnh trình duyệt.
Anthropic tuyên bố mô hình Opus 5 của họ hầu như miễn nhiễm với các cuộc tấn công tiêm nhiễm prompt trong kịch bản agent trình duyệt. Trong 129 kịch bản kiểm thử, tỷ lệ thành công của cuộc tấn công bằng không; trong bài kiểm tra tiêm nhiễm prompt chung của Gray Swan, tỷ lệ thành công sau 15 lần thử đã giảm từ 5.5% của Opus 4.8 xuống 2.0%. Tỷ lệ thành công bằng không chỉ đạt được khi các sản phẩm như Claude Cowork bật chế độ Auto Mode, chế độ này kết hợp hai lớp phòng thủ là quét đầu vào và chặn thực thi. Tiêm nhiễm prompt được coi là một trong những mối nguy hiểm bảo mật lớn nhất mà agent AI phải đối mặt, cải tiến này có thể đánh dấu rằng vấn đề này đã được giảm thiểu hiệu quả trong các kịch bản cụ thể.
Tin từ TechFlow, ngày 25 tháng 7, Anthropic thông báo mô hình Opus 5 của họ hầu như miễn nhiễm với các cuộc tấn công tiêm nhiễm prompt trong kịch bản agent trình duyệt. Trong 129 kịch bản kiểm thử, tỷ lệ thành công của cuộc tấn công là 0; trong bài kiểm tra tiêm nhiễm prompt chung của Gray Swan, tỷ lệ thành công sau 15 lần thử đã giảm từ 5,5% của Opus 4.8 xuống 2,0%. Tỷ lệ thành công 0% chỉ đạt được khi các sản phẩm như Claude Cowork bật chế độ Auto Mode, chế độ này kết hợp hai lớp phòng thủ gồm quét đầu vào và chặn thực thi. Tiêm nhiễm prompt được coi là một trong những rủi ro bảo mật lớn nhất mà các agent AI phải đối mặt, cải tiến lần này có thể đánh dấu vấn đề này đã được giảm thiểu hiệu quả trong các kịch bản cụ thể.




