Opus 5 от Anthropic достиг нулевого показателя успешных атак prompt injection во всех 129 сценариях браузерного тестирования

Anthropic объявила 25 июля, что её модель Opus 5 достигла успешности 0% против атак prompt injection в 129 сценариях тестирования в браузере. В универсальном бенчмарке Gray Swan по prompt injection успешность модели снизилась до 2,0% с 5,5% у Opus (при показателе Opus 4,8–5,5%) за 15 попыток. Нулевые показатели успешности были достигнуты исключительно при включённом Автоматическом режиме в Claude Cowork и аналогичных продуктах, которые объединяют защиты от сканирования входных данных и блокировки выполнения.
Дисклеймер: Информация на этой странице может быть получена из источников третьих сторон и предоставляется только для ознакомления. Она не отражает взгляды или мнения Gate и не является финансовой, инвестиционной или юридической рекомендацией. Торговля виртуальными активами связана с высоким риском. Пожалуйста, не основывайте свои решения исключительно на данных этой страницы. Подробнее смотрите в Дисклеймере.
комментарий
0/400
Нет комментариев