Кража inference-time harness в мультиагентных LLM-системах: методология извлечения и PoC

Статус
Закрыто для дальнейших ответов.

Александр Панкратов

Administrator
Команда форума
Матрёшка на тёмном антистатическом коврике раскрыта: вместо внутренней фигурки — прозрачный акриловый блок с переплетением тонких проводов. На внешней скорлупе выгравирована надпись HARNESS EXTRAC...



🧬 0% Attack Success Rate на одном канале инъекции и 100% на другом — с идентичным payload и той же frontier-моделью. Уязвимость не в LLM, а в harness: system prompt, tool schemas, memory, permissions.

Kill-chain canary methodology...


Кража inference-time harness в мультиагентных LLM-системах: методология извлечения и PoC

Источник: codeby.net
 
Статус
Закрыто для дальнейших ответов.
Назад
Верх