Атаки на AI-системы в пентесте: prompt injection, jailbreak и adversarial ML

Статус
Закрыто для дальнейших ответов.

Александр Панкратов

Administrator
Команда форума
Плата одноплатного компьютера на чёрном антистатическом коврике с вскрытым экраном и обгоревшим чипом. Маленький OLED-дисплей отображает зелёный текст, одиночный красный светодиод горит в глубокой...



🧠 Jailbreak-атаки на GPT-4 и Claude показывают ASR выше 80% — при включённых safety-фильтрах. В реальном RAG-финтех-приложении системный промпт с API-ключами к микросервисам вытащили быстрее, чем поднялся Burp Suite.

Поверхность атаки LLM...


Атаки на AI-системы в пентесте: prompt injection, jailbreak и adversarial ML

Источник: codeby.net
 
Статус
Закрыто для дальнейших ответов.
Назад
Верх