INTEGRITY Документация

AI Security for Apps

Приложения, использующие большие языковые модели (LLM) подвержены угрозам, специфичным для того, как LLM обрабатывают входные данные: атакам prompt injection, попаданию PII в промпты и промптам на небезопасные темы.

AI Security for Apps (ранее Firewall for AI) дополняет ваши существующие правила WAF механизмами обнаружения, разработанными для этих специфичных для LLM угроз. Он не зависит от модели — обнаружение работает независимо от того, какую LLM вы используете.

Когда функция включена, AI Security for Apps сканирует входящие запросы к эндпоинты с меткой cf-llm на наличие LLM-промптов, которые могут содержать угрозы. В настоящее время обнаружение обрабатывает только запросы с типом содержимого JSON (application/json).

По результатам сканирования Cloudflare заполняет Поля обнаружения AI — поля, которые можно использовать в выражениях правил WAF. Эти поля можно использовать двумя способами:

Доступность

Возможности AI Security for Apps зависят от тарифного плана Cloudflare:

Возможность Free Pro Business Enterprise
Обнаружение LLM-эндпоинтов — автоматическое выявление эндпоинтов на основе ИИ во всех ваших веб-ресурсах Да Да Да Да
AI Security Log Mode Ruleset — готовый набор правил, журналирующий полное тело запроса вместе с результатами обнаружения Нет Нет Нет Платное дополнение
Поля обнаружения AI — обнаружение PII, оценка инъекций промптов, обнаружение небезопасных тем, пользовательские темы Нет Нет Нет Платное дополнение

Чтобы получить доступ к AI Security Log Mode Ruleset и включите Поля обнаружения AI, обратитесь к своей команде сопровождения (account team).

AI Security for Apps встроен в Cloudflare Web Application Firewall (WAF) — WAF должен быть включён в вашей зоне, прежде чем поля обнаружения смогут заполняться и использоваться в выражениях правил.

Дополнительные ресурсы