Флагманское правило модуля AI Security (OWASP LLM Top 10, LLM01). Обнаруживает попытки промпт-инъекций во входных запросах пользователей к LLM-приложениям: игнорирование инструкций, подмена роли, джейлбрейки, извлечение системного промпта, обфускация кодированием.
Как работает
- Источник: события LLM-шлюза в индексах
gen_ai_events* (event_type = request_completed, непустое поле question). - Логика: текст запроса сверяется с библиотекой регулярных выражений из справочника
prompt_injection_patterns — 45 сигнатур на русском и английском языках, сгруппированных по техникам (подмена инструкций, ролевая игра, джейлбрейк, извлечение промпта, обход ограничений, кодирование, косвенные инъекции). При срабатывании фиксируются имя сигнатуры и подкатегория техники. - Расписание:
*/14 * * * *; троттлинг — 5 минут.
В карточке инцидента: сервис, модель, пользователь, текст запроса, сработавшая сигнатура и рекомендации по реагированию (включая корреляцию с правилами LLM07 — опасные действия после инъекции).