Атаки на LLM системы: от prompt injection до компрометации AI-агента

Статус
Закрыто для дальнейших ответов.

Александр Панкратов

Administrator
Команда форума
Плата одноплатного компьютера крупным планом на чёрном антистатическом коврике. Экран отображает надпись о уязвимости инъекции, обгоревшая дорожка подсвечена красным светодиодом.



🧠 GPT-4 и Claude 2 ломаются в 80–90% случаев при roleplay, encoding и multi-turn escalation — а в production RAG-системах результаты ещё хуже, потому что атакующий отравляет контекст до того, как модель его прочитает.

Kill chain атаки на LLM покрыт MITRE...


Атаки на LLM системы: от prompt injection до компрометации AI-агента

Источник: codeby.net
 
Статус
Закрыто для дальнейших ответов.
Назад
Верх