← Документация WAF / detections
AI Security for Apps
Приложения, использующие большие языковые модели (LLM) подвержены угрозам, специфичным для того, как LLM обрабатывают входные данные: атакам prompt injection, попаданию PII в промпты и промптам на небезопасные темы.
AI Security for Apps (ранее Firewall for AI) дополняет ваши существующие правила WAF механизмами обнаружения, разработанными для этих специфичных для LLM угроз. Он не зависит от модели — обнаружение работает независимо от того, какую LLM вы используете.
- Обнаружение PII — обнаружение персональных данных (PII) во входящих промптах: номеров телефонов, адресов электронной почты, номеров социального страхования и номеров банковских карт.
- Обнаружение небезопасных и пользовательских тем — обнаружение промптов на небезопасные темы, такие как насильственные преступления или разжигание ненависти, а также на пользовательские темы, специфичные для вашей организации.
- Обнаружение инъекций в промпт — обнаружение промптов, направленных на подрыв заданного поведения вашей LLM, например попыток заставить модель игнорировать инструкции или раскрыть системный промпт.
Когда функция включена, AI Security for Apps сканирует входящие запросы к эндпоинты с меткой cf-llm на наличие LLM-промптов, которые могут содержать угрозы. В настоящее время обнаружение обрабатывает только запросы с типом содержимого JSON (application/json).
По результатам сканирования Cloudflare заполняет Поля обнаружения AI — поля, которые можно использовать в выражениях правил WAF. Эти поля можно использовать двумя способами:
- Отслеживайте: Отфильтруйте по
cf-llmметку в Security Analytics , чтобы просмотреть результаты обнаружения по вашему трафику. - Митигация: Используйте поля в пользовательские правила или правила rate limiting, чтобы блокировать запросы или применять к ним челлендж на основе результатов обнаружения.
Доступность
Возможности AI Security for Apps зависят от тарифного плана Cloudflare:
| Возможность | Free | Pro | Business | Enterprise |
|---|---|---|---|---|
| Обнаружение LLM-эндпоинтов — автоматическое выявление эндпоинтов на основе ИИ во всех ваших веб-ресурсах | Да | Да | Да | Да |
| AI Security Log Mode Ruleset — готовый набор правил, журналирующий полное тело запроса вместе с результатами обнаружения | Нет | Нет | Нет | Платное дополнение |
| Поля обнаружения AI — обнаружение PII, оценка инъекций промптов, обнаружение небезопасных тем, пользовательские темы | Нет | Нет | Нет | Платное дополнение |
Чтобы получить доступ к AI Security Log Mode Ruleset и включите Поля обнаружения AI, обратитесь к своей команде сопровождения (account team).
AI Security for Apps встроен в Cloudflare Web Application Firewall (WAF) — WAF должен быть включён в вашей зоне, прежде чем поля обнаружения смогут заполняться и использоваться в выражениях правил.
Дополнительные ресурсы
- AI Gateway — мониторинг, контроль и кеширование запросов к провайдерам LLM.
- Что такое OWASP Top 10 рисков для LLM? ↗ — обзор самых распространённых рисков безопасности для приложений на основе LLM.