Защита LLM от prompt injection: guardrails, валидация и архитектурные меры для SOC-команд

Статус
Закрыто для дальнейших ответов.

Александр Панкратов

Administrator
Команда форума
Тёмная лаборатория SOC ночью: на широком мониторе терминал с конфигурацией NeMo Guardrails и надписью «LLM01:2025 PROMPT INJECTION» янтарным шрифтом, на втором экране отклонённый вредоносный запрос...



🧠 Кандидат вписал в резюме белым текстом на белом фоне «Ignore all previous instructions» — HR-скрининг на LLM выполнил команду без единой проверки. OWASP второй год держит prompt injection на первой строчке LLM Top 10.

Character...


Защита LLM от prompt injection: guardrails, валидация и архитектурные меры для SOC-команд

Источник: codeby.net
 
Статус
Закрыто для дальнейших ответов.
Назад
Верх