Inference hooks отправляют подсказки из вашей организации на выбранный вами сервер безопасности ИИ и удерживают каждый запрос до получения вердикта «разрешить» или «запретить», прежде чем Claude обработает его. На этой странице описано, как включить функцию, подключить ваш сервер и управлять применением вердиктов. О том, что такое Inference hooks и когда их использовать, см. в обзоре Inference hooks. О создании самого сервера безопасности ИИ см. в разделе Разработка интеграции Inference hooks.
Вам потребуется:
organization:manage в claude.ai. Им обладают встроенные роли Admin, Owner и Primary owner, а также любая пользовательская роль, которой оно предоставлено.https:// на порту 443, на публично маршрутизируемом хосте, доступный без перенаправлений. Полные требования к хостингу, а также инструкции по созданию сервера и проверке подписанных запросов см. в разделе Разработка интеграции Inference hooks.Существует три состояния применения вердиктов: выключено (Enforce verdicts выключено: ваш сервер безопасности ИИ не вызывается, подсказки не проверяются), теневой режим (Enforce verdicts включено, Mode установлен в Shadow mode: ваш сервер безопасности ИИ получает подсказки и возвращает вердикты, но ничего не блокируется) и применение (Enforce verdicts включено, Mode установлен в Allow the request или Block the request: вердикт «запретить» блокирует запрос). Следующие шаги проведут новую конфигурацию от выключенного состояния до применения вердиктов.
Разрешите Inference hooks для вашей организации
Перейдите в claude.ai > Organization settings > Data and privacy и найдите раздел Inference hooks. Включите Allow for your organization.
Включение этого параметра открывает страницу настроек Inference hooks и всегда принудительно выключает Enforce verdicts, поэтому разрешение функции само по себе никогда не запускает проверку: даже конфигурация, в которой ранее было включено применение вердиктов, остаётся без проверки, пока вы снова не включите Enforce verdicts на последнем шаге.
Откройте страницу настроек Inference hooks
Оставаясь в разделе Data and privacy, откройте раздел Inference hooks, чтобы перейти на страницу настроек Inference hooks. Она находится внутри раздела Data and privacy, а не как отдельный пункт в навигации настроек, поэтому её навигационная цепочка выглядит как Data and privacy / Inference hooks. Пока вы не сохраните эндпоинт, страница предупреждает, что подсказки ещё не проверяются, а Enforce verdicts остаётся выключенным с пометкой Requires endpoint.
Настройте ваш эндпоинт
Нажмите Configure, чтобы открыть диалог Configure endpoint, и заполните:
https://, который принимает запросы вердиктов. Принимаются только URL вида https://.- вместо _ и не должны совпадать с зарезервированными именами (заголовки формирования запроса, такие как Content-* и Host, заголовки прокси и cookie, заголовки адреса клиента, такие как X-Forwarded-*, заголовки подписи webhook-* и префикс X-Anthropic-*). Значения должны быть печатаемыми символами ASCII.Диалог охватывает только эти два поля и кнопку Test connection; он не спрашивает об обработке сбоев — её вы выбираете на шаге 6. После сохранения эндпоинта кнопка меняется на Edit.
Проверьте соединение
Нажмите Test connection. Claude отправляет синтетическую тестовую подсказку на URL и заголовки, которые в данный момент указаны в форме, а не на сохранённые значения, поэтому перед тестированием повторно введите все сохранённые значения заголовков. При успехе результат сообщает, вернул ли ваш сервер безопасности ИИ вердикт «разрешить» или «запретить» для тестовой подсказки, что позволяет выявить политику «запрещать всё по умолчанию» до начала применения вердиктов.
Распространённые результаты сбоев:
| Результат | Что проверить |
|---|---|
| URL rejected | URL не прошёл структурную проверку. Используйте URL вида https:// на порту 443. |
| Private or internal IP | Хост разрешается в частный или внутренний адрес. Используйте публично маршрутизируемый хост. |
| Timeout | Сервер безопасности ИИ не вернул вердикт в течение тайм-аута. |
| Transport error | Сбой разрешения DNS, TLS-рукопожатия или соединения. |
| Non-200 status | Сервер безопасности ИИ ответил со статусом, отличным от 200. Вердикты должны возвращаться как HTTP 200; перенаправления не обрабатываются и считаются сбоями. |
| Unparseable response | Сервер безопасности ИИ ответил, но тело ответа не является допустимым вердиктом. |
Сохраните и запишите ваш секрет подписи
Сохраните конфигурацию эндпоинта. При первом сохранении генерируется ваш секрет подписи вебхука, который показывается один раз. Скопируйте его и сохраните в надёжном месте, прежде чем закрыть диалог: секрет нельзя получить позже, только сменить.
Ваш сервер безопасности ИИ использует этот секрет для проверки подписи каждого получаемого запроса. Процедуру проверки см. в разделе Проверка подписи.
Выберите обработку сбоев и тайм-аут
В разделе Failure handling установите Mode, чтобы выбрать, что происходит, когда сервер безопасности ИИ недоступен или вердикты превышают тайм-аут:
Третий вариант в раскрывающемся списке, Shadow mode, — это инструмент развёртывания, а не политика обработки сбоев; см. Теневой режим.
Затем установите Prompt verdict timeout (ms): от 1 до 10 000 мс, по умолчанию 5 000 мс. Бюджет охватывает весь обмен, и более медленный вердикт считается недоступным сервером, поэтому установите наименьшее значение, которое ваш сервер может надёжно выдерживать.
Изменения в этом разделе сохраняются по мере внесения. При первом сохранении значения по умолчанию — Allow the request и 5 000 мс.
Выберите процент развёртывания
В разделе Rollout установите Requests inspected (%), чтобы запускать проверку для определённого процента запросов, пока вы вводите в работу ваш сервер безопасности ИИ. Значение варьируется от 0 до 100: 100 проверяет всё, а 0 отключает проверку.
Каждый запрос получает случайное значение один раз на весь ход разговора, поэтому один разговор может быть частично проверен на разных ходах. Запросы вне выбранного процента проходят без проверки, даже если обработка сбоев установлена в Block the request.
Включите Enforce verdicts
Чтобы оценить вердикты на реальном трафике, никого поначалу не блокируя, установите Mode в Shadow mode (шаг 6) перед включением применения вердиктов; см. Теневой режим.
Включите Enforce verdicts, чтобы Claude ожидал вердикта вашего сервера безопасности ИИ для каждой контролируемой подсказки, затем подтвердите в диалоге, который повторяет ваш выбор обработки сбоев. Подождите около минуты, пока изменение достигнет каждого сервера Anthropic; запросы, уже находящиеся в обработке, завершаются по старой настройке. Выключение прекращает отправку подсказок на ваш сервер безопасности ИИ, также примерно в течение минуты; ваша конфигурация сохраняется.
Теневой режим запускает ваш хук на реальном трафике, ничего не блокируя. Ваш сервер безопасности ИИ получает контролируемые подсказки и возвращает вердикты точно так же, как при применении, но ничего не блокируется: каждый запрос проходит к модели, даже когда ваш сервер отклоняет его или недоступен, и конечный пользователь ничего не видит. Используйте его для настройки вашей политики на реальном трафике вашей организации, прежде чем начать применение вердиктов.
Чтобы использовать теневой режим, установите Mode в Shadow mode в разделе Failure handling, затем включите Enforce verdicts, чтобы подсказки поступали на ваш сервер безопасности ИИ. Пока он активен, на странице настроек отображается пометка Shadow mode — not blocking. Чтобы выйти из теневого режима, установите Mode обратно в Allow the request или Block the request; вердикты снова применяются, как только включено применение.
В разделе Exclusions выберите роли, участники которых не охватываются Inference hooks: их подсказки никогда не отправляются на ваш сервер безопасности ИИ. Исключить можно только пользовательские роли, созданные вашей организацией; встроенные роли не предлагаются. Выберите их в селекторе ролей, плейсхолдер которого гласит Select roles to exclude, и управляйте тем, кто имеет каждую роль, на странице администрирования ролей (Manage roles); изменение исключений требует разрешения на управление идентификацией. Список по умолчанию пуст, и без исключённых ролей проверяется каждый контролируемый запрос.
Исключение применяется к интерактивным сессиям пользователя; трафик, аутентифицированный машинными учётными данными, всегда проверяется. Если Claude не может определить принадлежность запрашивающего к роли, запрос завершается с блокировкой и повторяемой ошибкой, а не проходит без проверки. Изменения списка исключений записываются в журнал аудита.
В разделе Custom blocked prompt message задайте пользовательский текст длиной до 500 символов, который добавляется к ошибке, которую видит конечный пользователь, когда ваш сервер безопасности ИИ отклоняет запрос (обычно — к кому обратиться или где запросить исключение). Итоговое сообщение состоит из deny_reason вашего сервера безопасности ИИ для конкретного запроса (если присутствует), пустой строки, затем этого текста. Если пользовательский текст не настроен, встроенное сообщение по умолчанию направляет пользователя к администраторам; вы также можете полностью отключить добавляемое сообщение, чтобы пользователь видел только deny_reason.
Область состояния эндпоинта на странице настроек Inference hooks показывает:
Панель работает по принципу «насколько возможно»: если Anthropic не может прочитать счётчики, она показывает ноль сбоев и отсутствие ошибок вместо собственной ошибки, поэтому здоровый вид панели сам по себе не является доказательством того, что ваш сервер безопасности ИИ исправен. Failures per minute учитывает каждый сбой, включая сетевые и DNS-ошибки, которые никогда не вызывают срабатывание предохранителя, поэтому это значение может быть высоким, пока Circuit breaker tripped остаётся пустым.
Устойчивые сбои вебхука, относимые к вашему серверу безопасности ИИ, вызывают срабатывание предохранителя, который останавливает применение вердиктов: ваш сервер больше не вызывается, и ваш выбор Failure handling применяется к каждому проверяемому запросу. При выбранном Block the request пользователи в вашей организации блокируются, пока вы не примете меры. Когда предохранитель срабатывает, администраторы также получают уведомление в центре уведомлений claude.ai.
Для восстановления исправьте сервер, затем снова включите Enforce verdicts, чтобы сбросить предохранитель.
Нажмите Rotate secret в разделе Request signing, чтобы заменить ваш секрет подписи. Смена — это немедленное переключение: новый секрет генерируется и показывается один раз, старый секрет больше нельзя получить, и ни один запрос никогда не подписывается обоими секретами, поэтому периода перекрытия, на который можно было бы рассчитывать, нет.
Запросы, подписанные предыдущим секретом, могут ещё кратковременно поступать после смены; раздел Проверка подписи описывает, как ваш сервер безопасности ИИ должен обрабатывать переключение.
Активность Inference hooks записывается в Activity Feed вашей организации: изменения конфигурации, отказы и запросы, прошедшие без проверки в соответствии с вашей настройкой обработки сбоев. Записи об отказах содержат идентификаторы, позволяющие сопоставить каждый отказ с соответствующей записью в вашей собственной системе.
Существует два уровня отключения:
Создайте сервер безопасности ИИ: схемы запросов и вердиктов, проверка подписи и операционная семантика.
Что такое Inference hooks, как работает цикл обмена вердиктами и что отправляется на ваш сервер безопасности ИИ.
Was this page helpful?