Os Inference hooks enviam prompts da sua organização para um servidor de segurança de IA que você escolhe e retêm cada solicitação aguardando um veredito de permissão ou negação antes que o Claude a processe. Esta página orienta você a ativar o recurso, conectar seu servidor e controlar a aplicação. Para saber o que são Inference hooks e quando usá-los, consulte a visão geral dos Inference hooks. Para construir o próprio servidor de segurança de IA, consulte Desenvolver uma integração de Inference hooks.
Você precisa de:
organization:manage no claude.ai. As funções integradas Admin, Owner e Primary owner a possuem, assim como qualquer função personalizada à qual ela tenha sido concedida.https:// na porta 443, em um host publicamente roteável, acessível sem redirecionamentos. Para os requisitos de hospedagem completos e para construir o servidor e verificar solicitações assinadas, consulte Desenvolver uma integração de Inference hooks.Existem três estados de aplicação: desativado (Enforce verdicts está desativado: seu servidor de segurança de IA nunca é contatado e os prompts não são inspecionados), shadow (Enforce verdicts está ativado com Mode definido como Shadow mode: seu servidor de segurança de IA recebe prompts e retorna vereditos, e nada é bloqueado) e aplicando (Enforce verdicts está ativado com Mode definido como Allow the request ou Block the request: uma negação bloqueia a solicitação). As etapas a seguir levam uma nova configuração de desativado até aplicando.
Permitir Inference hooks para sua organização
Vá para claude.ai > Organization settings > Data and privacy e encontre a seção Inference hooks. Ative Allow for your organization.
Ativar isso desbloqueia a página de configurações de Inference hooks e sempre força Enforce verdicts a ficar desativado, de modo que permitir o recurso nunca inicia a inspeção por si só: mesmo uma configuração que anteriormente tinha a aplicação ativada permanece sem inspeção até que você reative Enforce verdicts na etapa final.
Abrir a página de configurações de Inference hooks
Ainda em Data and privacy, abra a seção Inference hooks para acessar a página de configurações de Inference hooks. Ela fica em Data and privacy em vez de ter sua própria entrada na navegação de configurações, então seu breadcrumb exibe Data and privacy / Inference hooks. Até que você salve um endpoint, a página avisa que os prompts ainda não estão sendo inspecionados, e Enforce verdicts permanece desativado com um selo Requires endpoint.
Configurar seu endpoint
Clique em Configure para abrir a caixa de diálogo Configure endpoint e preencha:
https:// que recebe solicitações de veredito. Apenas URLs https:// são aceitas.- em vez de _, e não devem colidir com nomes reservados (cabeçalhos de enquadramento de solicitação como Content-* e Host, cabeçalhos de proxy e cookie, cabeçalhos de endereço de cliente como X-Forwarded-*, os cabeçalhos de assinatura webhook-* e o prefixo X-Anthropic-*). Os valores devem ser ASCII imprimível.A caixa de diálogo cobre apenas esses dois campos mais Test connection; ela não pergunta sobre tratamento de falhas, que você escolhe na etapa 6. Depois que um endpoint é salvo, o botão passa a exibir Edit.
Testar a conexão
Clique em Test connection. O Claude envia um prompt de teste sintético para a URL e os cabeçalhos atualmente no formulário, não os valores salvos, então reinsira quaisquer valores de cabeçalho armazenados antes de testar. Em caso de sucesso, o resultado informa se seu servidor de segurança de IA retornou um veredito de permissão ou de negação para o prompt de teste, o que revela um padrão de negar tudo antes de você começar a aplicar.
Resultados de falha comuns:
| Resultado | O que verificar |
|---|---|
| URL rejeitada | A URL falhou em uma verificação estrutural. Use uma URL https:// na porta 443. |
| IP privado ou interno | O host resolve para um endereço privado ou interno. Use um host publicamente roteável. |
| Timeout | O servidor de segurança de IA não retornou um veredito dentro do tempo limite. |
| Erro de transporte | A resolução de DNS, o handshake TLS ou a conexão falhou. |
| Status diferente de 200 | O servidor de segurança de IA respondeu com um status diferente de 200. Os vereditos devem retornar como HTTP 200; redirecionamentos não são seguidos e contam como falhas. |
| Resposta não analisável | O servidor de segurança de IA respondeu, mas o corpo não é um veredito válido. |
Salvar e armazenar seu segredo de assinatura
Salve a configuração do endpoint. O primeiro salvamento gera seu segredo de assinatura de webhook e o revela uma única vez. Copie-o e armazene-o com segurança antes de fechar a caixa de diálogo: o segredo não pode ser recuperado posteriormente, apenas rotacionado.
Seu servidor de segurança de IA usa esse segredo para verificar a assinatura em cada solicitação que recebe. Para o procedimento de verificação, consulte Verificar a assinatura.
Escolher tratamento de falhas e timeout
Em Failure handling, defina Mode para escolher o que acontece enquanto o servidor de segurança de IA está inacessível ou os vereditos atingem o tempo limite:
A terceira opção do menu suspenso, Shadow mode, é uma ferramenta de implementação gradual em vez de uma política de falha; consulte Shadow mode.
Em seguida, defina Prompt verdict timeout (ms): de 1 a 10.000 ms, com um padrão de 5.000 ms. O orçamento cobre toda a troca, e um veredito mais lento conta como um servidor inacessível, então defina o menor valor que seu servidor possa atender de forma confiável.
As alterações nesta seção são salvas conforme você as faz. No primeiro salvamento, os padrões são Allow the request e 5.000 ms.
Escolher uma porcentagem de implementação
Em Rollout, defina Requests inspected (%) para executar a inspeção em uma porcentagem de solicitações enquanto você coloca seu servidor de segurança de IA em operação. O valor varia de 0 a 100: 100 inspeciona tudo, e 0 desativa a inspeção.
Cada solicitação é sorteada uma vez para todo o seu turno de conversa, então uma única conversa pode ser parcialmente inspecionada ao longo dos turnos. Solicitações fora da porcentagem amostrada prosseguem sem inspeção, mesmo quando o tratamento de falhas está definido como Block the request.
Ativar Enforce verdicts
Para avaliar vereditos contra tráfego real sem bloquear ninguém inicialmente, defina Mode como Shadow mode (etapa 6) antes de ativar a aplicação; consulte Shadow mode.
Ative Enforce verdicts para condicionar o Claude ao veredito do seu servidor de segurança de IA para cada prompt governado, depois confirme na caixa de diálogo, que reafirma sua escolha de tratamento de falhas. Aguarde cerca de um minuto para que a alteração alcance todos os servidores da Anthropic; solicitações já em andamento terminam sob a configuração antiga. Desativá-lo interrompe o envio de prompts ao seu servidor de segurança de IA, novamente dentro de cerca de um minuto; sua configuração é mantida.
O shadow mode executa seu hook contra tráfego real sem bloquear nada. Seu servidor de segurança de IA recebe prompts governados e retorna vereditos exatamente como faria ao aplicar, mas nada é bloqueado: toda solicitação prossegue para o modelo, mesmo quando seu servidor a nega ou não pode ser alcançado, e o usuário final não vê nada. Use-o para ajustar sua política contra o tráfego real da sua organização antes de começar a aplicar.
Para usar o shadow mode, defina Mode como Shadow mode em Failure handling, depois ative Enforce verdicts para que os prompts fluam para seu servidor de segurança de IA. Enquanto estiver ativo, a página de configurações mostra um selo Shadow mode — not blocking. Para sair do shadow mode, defina Mode de volta para Allow the request ou Block the request; os vereditos são aplicados novamente assim que a aplicação estiver ativada.
Em Exclusions, selecione funções cujos membros não são cobertos pelos Inference hooks: seus prompts nunca são enviados ao seu servidor de segurança de IA. Apenas funções personalizadas que sua organização criou podem ser excluídas; as funções integradas não são oferecidas. Escolha-as no seletor de funções, cujo placeholder exibe Select roles to exclude, e gerencie quem possui cada função na página de administração de funções (Manage roles); alterar exclusões requer permissão de gerenciamento de identidade. A lista está vazia por padrão e, sem funções excluídas, toda solicitação governada é inspecionada.
A exclusão se aplica às sessões interativas de um usuário; o tráfego autenticado por credenciais de máquina é sempre inspecionado. Se o Claude não conseguir resolver a associação de função de um solicitante, a solicitação falha de forma fechada com um erro que permite nova tentativa, em vez de prosseguir sem inspeção. Alterações na lista de exclusão são registradas na trilha de auditoria.
Em Custom blocked prompt message, defina um texto personalizado de até 500 caracteres que é anexado ao erro que um usuário final vê quando seu servidor de segurança de IA nega uma solicitação (normalmente quem contatar ou onde solicitar uma exceção). A mensagem final é o deny_reason por solicitação do seu servidor de segurança de IA (quando presente), uma linha em branco e, em seguida, este texto. Sem texto personalizado configurado, um padrão integrado orienta o usuário a contatar seus administradores; você também pode desativar completamente a mensagem anexada para que o usuário veja apenas o deny_reason.
A área de integridade do endpoint na página de configurações de Inference hooks mostra:
O painel é de melhor esforço: se a Anthropic não conseguir ler os contadores, ele mostra zero falhas e nenhum erro em vez de um erro próprio, então um painel com aparência saudável não é, por si só, prova de que seu servidor de segurança de IA está saudável. Failures per minute conta todas as falhas, incluindo os erros de rede e DNS que nunca acionam o disjuntor, então pode estar alto enquanto Circuit breaker tripped permanece vazio.
Falhas sustentadas de webhook atribuíveis ao seu servidor de segurança de IA acionam o disjuntor, que interrompe a aplicação: seu servidor não é mais contatado, e sua escolha de Failure handling se aplica a toda solicitação inspecionada. Com Block the request selecionado, os usuários da sua organização ficam bloqueados até que você aja. Quando o disjuntor é acionado, os administradores também são notificados no centro de notificações do claude.ai.
Para recuperar, corrija o servidor e, em seguida, reative Enforce verdicts para redefinir o disjuntor.
Clique em Rotate secret em Request signing para substituir seu segredo de assinatura. A rotação é uma troca imediata: o novo segredo é gerado e revelado uma única vez, o segredo antigo não pode mais ser recuperado, e nenhuma solicitação é assinada com ambos os segredos, então não há período de sobreposição com o qual contar.
Solicitações assinadas com o segredo anterior ainda podem chegar brevemente após a rotação; Verificar a assinatura aborda como seu servidor de segurança de IA deve lidar com a transição.
A atividade de Inference hooks é registrada no Activity Feed da sua organização: alterações de configuração, negações e solicitações que prosseguiram sem inspeção sob sua configuração de tratamento de falhas. Os registros de negação carregam identificadores que permitem associar cada negação ao registro correspondente em seu próprio sistema.
Existem dois níveis de desativação:
Construa o servidor de segurança de IA: os esquemas de solicitação e veredito, verificação de assinatura e semântica operacional.
O que são Inference hooks, como funciona a ida e volta do veredito e o que é enviado ao seu servidor de segurança de IA.
Was this page helpful?