Inference hooks (хуки инференса) позволяют организации Claude Enterprise направлять каждую контролируемую подсказку через сервер ИИ-безопасности — HTTPS-сервис, которым управляет сама организация или её поставщик решений безопасности, — до выполнения инференса. Когда пользователь отправляет подсказку, Anthropic передаёт транскрипт разговора на ваш сервер ИИ-безопасности и ожидает вердикта «разрешить» или «запретить»; запрещённый запрос никогда не достигает модели. Команды безопасности и комплаенса используют Inference hooks для применения политик работы с данными в режиме реального времени, а разработчики создают сервер ИИ-безопасности, который оценивает каждый запрос.
Поскольку хук выполняется на серверах Anthropic — после того как запрос покидает клиент и до запуска модели, — он единообразно применяется к каждому контролируемому запросу, без необходимости что-либо устанавливать или развёртывать на устройствах пользователей.
На сегодняшний день единственным событием хука является prompt, которое срабатывает один раз на каждый контролируемый запрос инференса, до начала инференса. Контроль на стороне ответа планируется как отдельное событие в будущем.
POST на настроенную конечную точку сервера ИИ-безопасности вашей организации. Тело запроса содержит транскрипт разговора, и каждый запрос подписывается в соответствии со спецификацией Standard Webhooks после того, как ваша организация сгенерирует свой секрет подписи, чтобы ваш сервер мог убедиться, что запрос поступил от Anthropic.allow инференс продолжается в обычном режиме. При вердикте deny запрос отклоняется, и пользователь видит сообщение о блокировке политикой, состоящее из двух частей: причины для конкретного запроса, которую ваш сервер ИИ-безопасности указал в поле deny_reason вердикта, за которой следует постоянное сообщение, настроенное вашими администраторами (например, к кому обращаться или где запросить исключение). Если ваши администраторы не настроили такое сообщение, встроенное сообщение по умолчанию направляет пользователя обратиться к ним. Каждый отказ также фиксируется в Ленте активности вашей организации.Следующая диаграмма прослеживает один пример (запрос Cowork, в котором Claude также вызывает инструмент O365), чтобы показать, какие части потока перехватываются хуками. Точки перехвата — это шаги 1 и 5 на диаграмме, где поступает подсказка и возвращается результат инструмента; каждая из них приводит к обмену данными для валидации с вашим сервером ИИ-безопасности, показанному на шагах 2 и 6.
Вердикт — это небольшой JSON-объект: {"action": "allow"} позволяет запросу продолжиться, а отказ содержит причину, отображаемую пользователю. Полную схему вердикта см. в разделе Возврат вердикта.
Ваш сервер ИИ-безопасности видит то же, что и пользователь: текст транскрипта, вызовы инструментов и их результаты, а также текст, извлечённый из вложений. Он никогда не получает необработанные байты файлов или изображений, системные подсказки или внутренний контекст Anthropic.
Если ваш сервер ИИ-безопасности недоступен, возвращает ошибку или не отвечает в пределах тайм-аута, исход определяется настройкой обработки сбоев вашей организации: заблокировать запрос или позволить ему продолжиться без проверки.
Применение политик можно внедрять в удобном для вас темпе, так что никто не обязан быть заблокирован в первый же день: теневой режим наблюдает за вердиктами на реальном трафике, ничего не блокируя; процент развёртывания проверяет выбранную долю запросов; а исключения полностью освобождают участников выбранных ролей. См. Настройка Inference hooks.
Полные схемы запросов и ответов, проверку подписи и операционные детали см. в разделе Разработка интеграции.
allow — как push-альтернативу опросу Compliance API.Inference hooks доступны организациям Claude Enterprise. Для их настройки требуется разрешение organization:manage, которым обладают встроенные роли Admin, Owner и Primary owner, а также любая пользовательская роль, которой оно предоставлено.
Один хук управляет разговорами в claude.ai, Cowork и сессиях Claude Code в вашей организации Claude Enterprise, независимо от того, выполняются ли они в веб-версии, в настольном приложении или в CLI. Inference hooks недоступны на Amazon Bedrock или Google Cloud.
Контролируемые запросы — это запросы инференса, стоящие за разговором пользователя. Вспомогательные запросы, такие как генерация заголовка разговора, не отправляются на вашу конечную точку, а системные подсказки и определения инструментов никогда не включаются в отправляемые данные. Голосовой режим не охватывается.
Обе функции предназначены для команд безопасности, юридических отделов и комплаенса в организациях Claude Enterprise.
| Inference hooks | Compliance API | |
|---|---|---|
| Когда действует | В режиме реального времени, до выполнения инференса | Постфактум |
| Что делает | Разрешает или запрещает каждый контролируемый запрос в реальном времени | Извлекает активность, чаты, файлы, проекты, транскрипты сессий Cowork и Claude Code, а также пользователей для аудита и экспорта |
| Направление | Anthropic вызывает ваш сервер ИИ-безопасности | Вы вызываете API Anthropic |
Используйте Inference hooks, чтобы остановить запрос до того, как он достигнет модели, и Compliance API, чтобы провести аудит произошедшего впоследствии.
Включите Inference hooks для вашей организации, настройте и протестируйте ваш сервер ИИ-безопасности, выберите обработку сбоев и применяйте вердикты.
Схемы запросов и вердиктов, проверка подписи, операционная семантика и шаблоны интеграции для создания сервера ИИ-безопасности.
Was this page helpful?