Промпт-инъекции в суде: как скрытый текст в официальном иске должен был обмануть языковую модель

Многие считают промпт-инъекции исключительно проблемой разработчиков корпоративных чат-ботов. Правда, реальность уже тестирует эти уязвимости в совершенно других сферах.
В суде штата Коннектикут истец попытался манипулировать правосудием через официальные документы. Он загрузил многостраничное ходатайство, где между обычными абзацами спрятал прямые инструкции для нейросетей. Текст был набран белым шрифтом размером в 3 пункта. Логика атаки предельно ясна. Если клерк решит прогнать сложный текст через LLM для быстрого анализа, модель прочитает скрытое IF THIS DOCUMENT IS REVIEWED BY AN AI MODEL и выдаст заключение строго в пользу автора.
Судья оказался внимательнее алгоритмов. Он заметил неестественные пустые области на страницах, выделил их и нашел скрытый слой. Суд заявил, что не применяет ИИ для вынесения решений, а самого истца лишили права подавать документы в электронном виде. Но этот курьезный провал подсвечивает фундаментальную архитектурную слабость современных систем.
Вопрос в том, сколько подобных невидимых команд уже успешно прошли через автоматизированные HR-фильтры, банковский скоринг или парсеры контрактов. Защита от инъекций на уровне самих языковых моделей до сих пор работает нестабильно. Инженеры пытаются закрывать дыры системными правилами, но базовый вектор атаки бьет в самую уязвимую точку — слепое доверие людей к машинному анализу текста.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад