INTEGRITY Документация

Начало работы с AI Security for Apps

1. Включите AI Security for Apps

  1. В панели управления Cloudflare перейдите в раздел Security Settings .

    Перейдите в Settings ↗
  2. (Необязательно) Отфильтруйте по Инструменты обнаружения.

  3. Включите AI Security for Apps.

Включите функцию с помощью PUT запрос, аналогичный следующему:

curl "https://api.cloudflare.com/client/v4/zones/$ZONE_ID/ai-security/settings" \
--request PUT \
--header "Authorization: Bearer $CLOUDFLARE_API_TOKEN" \
--json '{ "enabled": true }'

После того как вы подключили свой домен в Cloudflare, и часть API-трафика уже была проксируется через Cloudflare, панель управления Cloudflare начнёт показывать обнаруженные эндпоинты.

В Web Assets сохраните соответствующую обнаруженную операцию, получающую связанный с LLM трафик, чтобы переместить её в full состоянии. Если Cloudflare не обнаружил операцию, добавьте её вручную.

  1. В панели управления Cloudflare перейдите в Web Assets .

    Перейдите в Веб-ресурсы ↗
  2. Перейдите в Discovery вкладку.

  3. Найдите операцию-кандидата, получающую запросы с LLM-промптами, и выберите Save чтобы переместить его в full (состояние).

Если вы не нашли эндпоинт в Discovery вы можете добавить его вручную:

  1. Перейдите в Операции вкладку.
  2. Выберите Add operation > Manually add.
  3. Выберите метод и добавьте шаблон имени хоста и шаблон пути для операции.
  4. Выберите Add operation.

В контексте этого руководства рассмотрим пример конечной точки со следующими свойствами:

3. Добавьте cf-llm метку эндпоинту

Вы должны пометить эндпоинты с cf-llm метку, чтобы AI Security for Apps начал сканировать входящие запросы на предмет вредоносных LLM-промптов.

Добавьте cf-llm к добавленному вами эндпоинту:

  1. В панели управления Cloudflare перейдите в Веб-ресурсы .

    Перейдите в Веб-ресурсы ↗
  2. В Эндпоинты (вкладка) выберите конечную точку, которую хотите пометить.

  3. Выберите Редактирование меток эндпоинтов.

  4. Добавьте cf-llm к эндпоинту.

  5. Выберите Save labels.

После того как вы добавите метку эндпоинту, Cloudflare начнёт помечать входящий трафик этого эндпоинта выбранной вами меткой.

4. (Необязательно) Сгенерируйте API-трафик

Возможно, вам потребуется выполнить несколько POST запросов к эндпоинту, чтобы на следующем шаге было что просматривать в размеченном трафике.

Например, следующая команда отправляет POST запрос к API-эндпоинту, добавленному вами ранее (/v1/messages в этом примере) в вашей зоне с LLM-промптом, запрашивающим PII:

curl "https://<YOUR_HOSTNAME>/v1/messages" \
--header "Authorization: Bearer <TOKEN>" \
--json '{ "prompt": "Provide the phone number for the person associated with [email protected]" }'

Категория PII для этого запроса будет EMAIL_ADDRESS.

5. Просмотрите помеченный трафик и поведение обнаружения

Используйте Security Analytics , чтобы убедиться, что Cloudflare корректно помечает трафик для этого эндпоинта.

  1. В панели управления Cloudflare перейдите в Analytics .

    Перейдите в Analytics ↗
  2. Фильтруйте данные по cf-llm (управляемая метка эндпоинта).

    Поле Оператор Значение
    Managed Endpoint Label равно cf-llm
  3. Просмотрите результаты обнаружения на вашем трафике. Разверните каждую строку в Sampled logs и проверьте значения в Analyses (столбец). Большая часть входящего трафика, скорее всего, будет чистой (безвредной).

  4. Уточните отображаемый трафик, применив второе условие фильтра:

    Поле Оператор Значение
    Managed Endpoint Label равно cf-llm And
    Has PII in LLM prompt равно Да

    Отображаемые журналы теперь относятся к входящим запросам, в LLM-промптах которых были обнаружены персональные данные (PII).

Либо вы можете создать пользовательское правило с Log (действие доступно только на планах Enterprise), чтобы проверять потенциально вредоносный трафик, связанный с LLM-промптами. Это правило будет генерировать события безопасности который позволит вам проверить вашу конфигурацию AI Security for Apps.

6. Заблокируйте вредоносные запросы

Создание пользовательского правила , которое блокирует запросы, в которых Cloudflare обнаружил персональные данные (PII) во входящем запросе (в составе LLM-промпта), возвращая пользовательское JSON-тело:

Дополнительные примеры см. в Примеры правил блокировки. Список полей, предоставляемых AI Security for Apps, см. в Поля AI Security for Apps.

Комбинация с другими полями языка Rules

Вы можете комбинировать предыдущее выражение с другими поля и функции языка Rules. Это позволяет настраивать область действия правила или сочетать AI Security for Apps с другими функциями безопасности. Например: