Claude Platform Docs
AdministraçãoHooks de inferência

Inference hooks

Envie cada prompt governado ao servidor de segurança de IA da sua organização para obter um veredito de permitir ou negar antes que a inferência prossiga.

Os "Inference hooks" (ganchos de inferência) permitem que uma organização Claude Enterprise encaminhe cada prompt governado por meio de um servidor de segurança de IA, um serviço HTTPS operado pela organização ou por seu fornecedor de segurança, antes que a inferência seja executada. Quando um usuário envia um prompt, a Anthropic envia a transcrição da conversa ao seu servidor de segurança de IA e aguarda um veredito de permitir ou negar; uma solicitação negada nunca chega ao modelo. Equipes de segurança e conformidade usam Inference hooks para aplicar políticas de dados inline, e desenvolvedores constroem o servidor de segurança de IA que avalia cada solicitação.

Como o hook é executado nos servidores da Anthropic, depois que a solicitação sai do cliente e antes que o modelo seja executado, ele se aplica a todas as solicitações governadas de forma uniforme, sem nada para instalar ou implantar nos dispositivos dos usuários.

Hoje, o único evento de hook é prompt, que dispara uma vez por solicitação de inferência governada, antes do início da inferência. A aplicação no lado da resposta está planejada como um evento posterior.


Como os Inference hooks funcionam

  1. Um usuário envia um prompt em uma superfície governada.
  2. A Anthropic envia um POST HTTPS ao endpoint do servidor de segurança de IA configurado pela sua organização. O corpo da solicitação carrega a transcrição da conversa, e cada solicitação é assinada de acordo com a especificação Standard Webhooks assim que sua organização gera seu segredo de assinatura, para que seu servidor possa verificar que ela veio da Anthropic.
  3. Seu servidor de segurança de IA avalia o conteúdo e responde com um veredito dentro do tempo limite de veredito que sua organização configura (5 segundos por padrão).
  4. Em caso de allow, a inferência prossegue normalmente. Em caso de deny, a solicitação é rejeitada e o usuário vê uma mensagem de bloqueio por política montada a partir de duas partes: o motivo por solicitação que seu servidor de segurança de IA forneceu no campo deny_reason do veredito, seguido de uma mensagem permanente que seus administradores configuram (por exemplo, quem contatar ou onde solicitar uma exceção). Se seus administradores não tiverem configurado uma, um padrão integrado orienta o usuário a contatá-los. Cada negação também é registrada no Feed de atividades da sua organização.

O diagrama a seguir acompanha um exemplo (uma solicitação do Cowork em que o Claude também chama uma ferramenta do O365) para ilustrar quais partes do fluxo passam pelo hook. Os pontos com hook são as etapas 1 e 5 do diagrama, onde o prompt chega e o resultado da ferramenta retorna; cada um resulta na troca de validação com seu "AI security server" (servidor de segurança de IA) mostrada nas etapas 2 e 6.

Diagrama de fluxo: o servidor de segurança de IA valida tanto o prompt quanto o resultado da ferramenta antes que a inferência prossiga

Um veredito é um pequeno objeto JSON: {"action": "allow"} permite que a solicitação prossiga, e um deny carrega o motivo exibido ao usuário. Para o esquema completo do veredito, consulte Retornar um veredito.

Seu servidor de segurança de IA vê o que o usuário vê: texto da transcrição, chamadas de ferramentas e seus resultados, e texto extraído de anexos. Ele nunca recebe bytes brutos de arquivos ou imagens, prompts do sistema ou contexto interno da Anthropic. A Anthropic não armazena conteúdo de prompts ou respostas como parte dos Inference hooks; ela registra apenas metadados sobre a atividade do hook, como vereditos, carimbos de data/hora e identificadores de solicitação.

Se seu servidor de segurança de IA estiver inacessível, retornar um erro ou não responder dentro do tempo limite, a configuração de tratamento de falhas da sua organização decide o resultado: bloquear a solicitação ou permitir que ela prossiga sem inspeção.

A aplicação pode ser implantada no seu ritmo, para que ninguém precise ser bloqueado no primeiro dia: o modo sombra observa vereditos no tráfego real sem bloquear nada, uma porcentagem de implantação inspeciona uma fração escolhida das solicitações, e exclusões isentam totalmente os membros de funções escolhidas. Consulte Configurar Inference hooks.

Para os esquemas completos de solicitação e resposta, verificação de assinatura e detalhes operacionais, consulte Desenvolver uma integração.


Casos de uso

  • Prevenção contra perda de dados (DLP). Encaminhe a transcrição ao seu scanner de "data loss prevention" (prevenção contra perda de dados), ou DLP, e negue prompts que carreguem material regulamentado ou classificado. Esta é a implantação mais comum.
  • Arquivamento de transcrições em tempo real. Arquive cada transcrição à medida que ela chega e sempre retorne allow, como uma alternativa baseada em push à consulta periódica da Compliance API.
  • Telemetria de prompts. Meça como sua organização usa o Claude, no momento do uso.
  • Mecanismos de políticas. Aplique suas próprias regras antes da inferência: listas de permissão de modelos, restrições com escopo de projeto ou controles de horário de trabalho.

Limitações atuais

  • Anexos são representados por metadados e texto extraído. Bytes brutos de arquivos e imagens nunca são enviados, portanto conteúdo somente em imagem (por exemplo, uma captura de tela de um documento) não é inspecionado.
  • Os vereditos são permitir ou negar. Reescrever ou redigir um prompt não é suportado.
  • Organizações de plataforma (acesso à API por meio da Claude Platform) estão fora do escopo.

Disponibilidade

Os Inference hooks estão disponíveis para organizações Claude Enterprise. Configurá-los requer a permissão organization:manage, que as funções integradas Admin, Owner e Primary owner possuem, assim como qualquer função personalizada à qual ela tenha sido concedida.

Um único hook governa conversas no claude.ai, no Cowork e em sessões do Claude Code na sua organização Claude Enterprise, sejam elas executadas na web, no aplicativo de desktop ou na CLI. Os Inference hooks não estão disponíveis no Amazon Bedrock nem no Google Cloud.

Solicitações governadas são as solicitações de inferência por trás da conversa do usuário. Solicitações auxiliares, como a geração de títulos de conversas, não são enviadas ao seu endpoint, e prompts do sistema e definições de ferramentas nunca são incluídos no que é enviado. O modo de voz não é coberto.


Inference hooks versus a Compliance API

Ambos os recursos atendem equipes de segurança, jurídicas e de conformidade em organizações Claude Enterprise.

Inference hooksCompliance API
Quando atuaInline, antes que a inferência seja executadaApós o fato
O que fazPermite ou nega cada solicitação governada em tempo realRecupera atividades, chats, arquivos, projetos, transcrições de sessões e usuários para auditoria e exportação
DireçãoA Anthropic chama seu servidor de segurança de IAVocê chama a API da Anthropic

Use os Inference hooks para interromper uma solicitação antes que ela chegue ao modelo, e a Compliance API para auditar o que aconteceu depois.


Nesta seção

Permita Inference hooks para sua organização, configure e teste seu servidor de segurança de IA, escolha o tratamento de falhas e aplique vereditos.

Os esquemas de solicitação e veredito, verificação de assinatura, semântica operacional e padrões de integração para construir o servidor de segurança de IA.

Was this page helpful?