Claude Platform Docs
АдминистрированиеХуки инференса

Inference hooks

Отправляйте каждую контролируемую подсказку на сервер безопасности ИИ вашей организации для получения вердикта «разрешить» или «отклонить» до того, как начнётся инференс.

Inference hooks (хуки инференса) позволяют организации Claude Enterprise направлять каждую контролируемую подсказку через «AI security server» (сервер безопасности ИИ) — HTTPS-сервис, которым управляет организация или её поставщик средств безопасности, — до запуска инференса. Когда пользователь отправляет подсказку, Anthropic отправляет транскрипт разговора на ваш сервер безопасности ИИ и ожидает вердикта «разрешить» или «отклонить»; отклонённый запрос никогда не достигает модели. Команды безопасности и комплаенса используют Inference hooks для применения политик в отношении данных непосредственно в потоке обработки, а разработчики создают сервер безопасности ИИ, который оценивает каждый запрос.

Поскольку хук выполняется на серверах Anthropic — после того как запрос покидает клиент и до того как запускается модель, — он единообразно применяется к каждому контролируемому запросу, и на устройствах пользователей ничего не нужно устанавливать или развёртывать.

На сегодняшний день единственное событие хука — prompt, которое срабатывает один раз для каждого контролируемого запроса на инференс, до начала инференса. Контроль на стороне ответа запланирован как более позднее событие.


Как работают Inference hooks

  1. Пользователь отправляет подсказку на контролируемой поверхности.
  2. Anthropic отправляет HTTPS-запрос POST на настроенную конечную точку сервера безопасности ИИ вашей организации. Тело запроса содержит транскрипт разговора, и каждый запрос подписывается в соответствии со спецификацией Standard Webhooks, как только ваша организация сгенерирует свой секрет подписи, чтобы ваш сервер мог убедиться, что запрос поступил от Anthropic.
  3. Ваш сервер безопасности ИИ оценивает содержимое и отвечает вердиктом в пределах тайм-аута вердикта, настроенного вашей организацией (по умолчанию 5 секунд).
  4. При allow инференс продолжается в обычном режиме. При deny запрос отклоняется, и пользователь видит сообщение о блокировке политикой, составленное из двух частей: причины для конкретного запроса, которую ваш сервер безопасности ИИ указал в поле deny_reason вердикта, за которой следует постоянное сообщение, настроенное вашими администраторами (например, к кому обратиться или где запросить исключение). Если ваши администраторы его не настроили, встроенное сообщение по умолчанию направляет пользователя обратиться к ним. Каждый отказ также записывается в Activity Feed (ленту активности) вашей организации.

Следующая диаграмма прослеживает один пример (запрос Cowork, в котором Claude также вызывает инструмент O365), чтобы показать, какие части потока перехватываются хуками. Точки перехвата — это шаги 1 и 5 на диаграмме, где поступает подсказка и возвращается результат инструмента; каждая из них приводит к обмену проверочными сообщениями с вашим сервером безопасности ИИ, показанному на шагах 2 и 6.

Диаграмма потока: AI security server (сервер безопасности ИИ) проверяет как prompt (подсказку), так и tool result (результат инструмента) до того, как продолжится инференс

Вердикт — это небольшой объект JSON: {"action": "allow"} позволяет запросу продолжиться, а отказ содержит причину, отображаемую пользователю. Полную схему вердикта см. в разделе Возврат вердикта.

Ваш сервер безопасности ИИ видит то, что видит пользователь: текст транскрипта, вызовы инструментов и их результаты, а также текст, извлечённый из вложений. Он никогда не получает необработанные байты файлов или изображений, системные подсказки или внутренний контекст Anthropic. Anthropic не хранит содержимое подсказок или ответов в рамках Inference hooks; записываются только метаданные об активности хуков, такие как вердикты, временные метки и идентификаторы запросов.

Если ваш сервер безопасности ИИ недоступен, возвращает ошибку или не отвечает в пределах тайм-аута, исход определяется настройкой обработки сбоев вашей организации: заблокировать запрос или разрешить ему продолжиться без проверки.

Контроль можно внедрять в удобном для вас темпе, так что никого не придётся блокировать в первый же день: теневой режим наблюдает за вердиктами на реальном трафике, ничего не блокируя, процент развёртывания проверяет выбранную долю запросов, а исключения полностью освобождают участников выбранных ролей. См. Настройка Inference hooks.

Полные схемы запросов и ответов, проверку подписи и эксплуатационные подробности см. в разделе Разработка интеграции.


Сценарии использования

  • «Data loss prevention» (предотвращение утечки данных), или DLP. Пересылайте транскрипт вашему DLP-сканеру и отклоняйте подсказки, содержащие регулируемые или секретные материалы. Это наиболее распространённый вариант развёртывания.
  • Архивирование транскриптов в реальном времени. Архивируйте каждый транскрипт по мере поступления и всегда возвращайте allow — как push-альтернативу опросу Compliance API.
  • Телеметрия подсказок. Измеряйте, как ваша организация использует Claude, в момент использования.
  • Движки политик. Применяйте собственные правила до инференса: списки разрешённых моделей, ограничения на уровне проектов или контроль рабочего времени.

Текущие ограничения

  • Вложения представлены метаданными и извлечённым текстом. Необработанные байты файлов и изображений никогда не отправляются, поэтому содержимое, состоящее только из изображений (например, снимок экрана документа), не проверяется.
  • Вердикты — это «разрешить» или «отклонить». Переписывание или редактирование подсказки не поддерживается.
  • Платформенные организации (доступ к API через Claude Platform) не входят в область действия.

Доступность

Inference hooks доступны организациям Claude Enterprise. Для их настройки требуется разрешение organization:manage, которым обладают встроенные роли Admin, Owner и Primary owner, а также любая пользовательская роль, которой оно предоставлено.

Один хук контролирует разговоры в claude.ai, Cowork и сеансах Claude Code в вашей организации Claude Enterprise, независимо от того, выполняются ли они в вебе, в настольном приложении или в CLI. Inference hooks недоступны в Amazon Bedrock или Google Cloud.

Контролируемые запросы — это запросы на инференс, лежащие в основе разговора пользователя. Вспомогательные запросы, такие как генерация заголовка разговора, не отправляются на вашу конечную точку, а системные подсказки и определения инструментов никогда не включаются в отправляемые данные. Голосовой режим не охватывается.


Inference hooks в сравнении с Compliance API

Обе функции служат командам безопасности, юридическим командам и командам комплаенса в организациях Claude Enterprise.

Inference hooksCompliance API
Когда действуетНепосредственно в потоке, до запуска инференсаПостфактум
Что делаетРазрешает или отклоняет каждый контролируемый запрос в реальном времениИзвлекает активность, чаты, файлы, проекты, транскрипты сеансов и пользователей для аудита и экспорта
НаправлениеAnthropic вызывает ваш сервер безопасности ИИВы вызываете API Anthropic

Используйте Inference hooks, чтобы остановить запрос до того, как он достигнет модели, а Compliance API — чтобы провести аудит произошедшего впоследствии.


В этом разделе

Разрешите Inference hooks для вашей организации, настройте и протестируйте ваш сервер безопасности ИИ, выберите обработку сбоев и применяйте вердикты.

Схемы запросов и вердиктов, проверка подписи, эксплуатационная семантика и шаблоны интеграции для создания сервера безопасности ИИ.

Was this page helpful?