Os "Inference hooks" (ganchos de inferência) permitem que uma organização Claude Enterprise encaminhe cada prompt governado por meio de um servidor de segurança de IA — um serviço HTTPS que a organização ou seu fornecedor de segurança opera — antes que a inferência seja executada. Quando um usuário envia um prompt, a Anthropic envia a transcrição da conversa para o seu servidor de segurança de IA e aguarda um veredito de permitir ou negar; uma solicitação negada nunca chega ao modelo. Equipes de segurança e conformidade usam Inference hooks para aplicar políticas de dados em linha, e desenvolvedores constroem o servidor de segurança de IA que avalia cada solicitação.
Como o hook é executado nos servidores da Anthropic, depois que a solicitação sai do cliente e antes que o modelo seja executado, ele se aplica uniformemente a todas as solicitações governadas, sem nada para instalar ou implantar nos dispositivos dos usuários.
Atualmente, o único evento de hook é prompt, que é disparado uma vez por solicitação de inferência governada, antes que a inferência comece. A aplicação do lado da resposta está planejada como um evento futuro.
POST HTTPS para o endpoint do servidor de segurança de IA configurado pela sua organização. O corpo da solicitação carrega a transcrição da conversa, e cada solicitação é assinada de acordo com a especificação Standard Webhooks assim que sua organização gera seu segredo de assinatura, para que seu servidor possa verificar que ela veio da Anthropic.allow, a inferência prossegue normalmente. Em caso de deny, a solicitação é rejeitada e o usuário vê uma mensagem de bloqueio por política composta de duas partes: o motivo por solicitação que seu servidor de segurança de IA forneceu no campo deny_reason do veredito, seguido por uma mensagem permanente que seus administradores configuram (por exemplo, quem contatar ou onde solicitar uma exceção). Se seus administradores não tiverem configurado uma, um padrão integrado orienta o usuário a contatá-los. Cada negação também é registrada no Activity Feed da sua organização.O diagrama a seguir traça um exemplo (uma solicitação do Cowork em que o Claude também chama uma ferramenta do O365) para ilustrar quais partes do fluxo passam pelo hook. Os pontos com hook são as etapas 1 e 5 do diagrama, onde o prompt chega e o resultado da ferramenta retorna; cada um resulta na troca de validação com seu servidor de segurança de IA mostrada nas etapas 2 e 6.
Um veredito é um pequeno objeto JSON: {"action": "allow"} permite que a solicitação prossiga, e um deny carrega o motivo exibido ao usuário. Para o esquema completo do veredito, consulte Retornar um veredito.
Seu servidor de segurança de IA vê o que o usuário vê: texto da transcrição, chamadas de ferramentas e seus resultados, e texto extraído de anexos. Ele nunca recebe bytes brutos de arquivos ou imagens, prompts do sistema ou contexto interno da Anthropic.
Se seu servidor de segurança de IA estiver inacessível, retornar um erro ou não responder dentro do tempo limite, a configuração de tratamento de falhas da sua organização decide o resultado: bloquear a solicitação ou permitir que ela prossiga sem inspeção.
A aplicação pode ser implementada no seu ritmo, para que ninguém precise ser bloqueado no primeiro dia: o modo sombra observa vereditos no tráfego ao vivo sem bloquear nada, uma porcentagem de implementação inspeciona uma fração escolhida de solicitações, e exclusões isentam completamente membros de funções escolhidas. Consulte Configurar Inference hooks.
Para os esquemas completos de solicitação e resposta, verificação de assinatura e detalhes operacionais, consulte Desenvolver uma integração.
allow, como uma alternativa baseada em push à consulta periódica da Compliance API.Os Inference hooks estão disponíveis para organizações Claude Enterprise. Configurá-los requer a permissão organization:manage, que as funções integradas Admin, Owner e Primary owner possuem, assim como qualquer função personalizada à qual ela tenha sido concedida.
Um único hook governa conversas no claude.ai, no Cowork e em sessões do Claude Code na sua organização Claude Enterprise, sejam elas executadas na web, no aplicativo desktop ou na CLI. Os Inference hooks não estão disponíveis no Amazon Bedrock ou no Google Cloud.
Solicitações governadas são as solicitações de inferência por trás da conversa do usuário. Solicitações auxiliares, como geração de título de conversa, não são enviadas para seu endpoint, e prompts do sistema e definições de ferramentas nunca são incluídos no que é enviado. O modo de voz não é coberto.
Ambos os recursos atendem equipes de segurança, jurídico e conformidade em organizações Claude Enterprise.
| Inference hooks | Compliance API | |
|---|---|---|
| Quando atua | Em linha, antes que a inferência seja executada | Após o fato |
| O que faz | Permite ou nega cada solicitação governada em tempo real | Recupera atividades, chats, arquivos, projetos, transcrições de sessões do Cowork e do Claude Code, e usuários para auditoria e exportação |
| Direção | A Anthropic chama seu servidor de segurança de IA | Você chama a API da Anthropic |
Use Inference hooks para interromper uma solicitação antes que ela chegue ao modelo, e a Compliance API para auditar o que aconteceu depois.
Habilite Inference hooks para sua organização, configure e teste seu servidor de segurança de IA, escolha o tratamento de falhas e aplique vereditos.
Os esquemas de solicitação e veredito, verificação de assinatura, semântica operacional e padrões de integração para construir o servidor de segurança de IA.
Was this page helpful?