Вы используете устаревший браузер. Этот и другие сайты могут отображаться в нем неправильно. Необходимо обновить браузер или попробовать использовать другой.
AI Security CTF: как проходить соревнования по безопасности ИИ — prompt injection, jailbreak и атаки на агентов
1.3% промптов из 195 411 попыток вскрыли CTF-бота TCM Security — остальные 27 884 инъекций заблокировал фильтр. GPT-4 без защит «сдаётся» в 87.2% случаев, Claude 2 — в 82.5%. Разрыв между голой моделью и hardened-ботом — это и есть поле AI Security CTF.
Direct prompt injection вида «Ignore all previous...
На данном сайте используются cookie-файлы, чтобы персонализировать контент и сохранить Ваш вход в систему, если Вы зарегистрируетесь.
Продолжая использовать этот сайт, Вы соглашаетесь на использование наших cookie-файлов.