Claude Opus 5 проходит все 129 тестов на внедрение инструкций в агентные запросы браузера без компрометации

В раскрытии Anthropic через AI-новостную платформу Beating Claude Opus 5 прошёл все 129 сценариев тестов на prompt injection для браузерных ИИ-агентов без компрометации, отметив значительный прорыв в безопасности ИИ-агентов. В универсальном бенчмарке prompt injection от Gray Swan Opus 5 показал 2,0% успешных атак после 15 попыток, существенно опередив своего предшественника Opus (4,8) при 5,5%, а также конкурирующие модели Mythos 5 с 2,6% и Fable 5 с 2,8%.
Дисклеймер: Информация на этой странице может быть получена из источников третьих сторон и предоставляется только для ознакомления. Она не отражает взгляды или мнения Gate и не является финансовой, инвестиционной или юридической рекомендацией. Торговля виртуальными активами связана с высоким риском. Пожалуйста, не основывайте свои решения исключительно на данных этой страницы. Подробнее смотрите в Дисклеймере.
комментарий
0/400
Нет комментариев