Gli "Inference hooks" (hook di inferenza) consentono a un'organizzazione Claude Enterprise di instradare ogni prompt governato attraverso un server di sicurezza IA, un servizio HTTPS gestito dall'organizzazione o dal suo fornitore di sicurezza, prima che l'inferenza venga eseguita. Quando un utente invia un prompt, Anthropic invia la trascrizione della conversazione al tuo server di sicurezza IA e attende un verdetto di autorizzazione o rifiuto; una richiesta rifiutata non raggiunge mai il modello. I team di sicurezza e conformità utilizzano gli Inference hooks per applicare le policy sui dati in linea, e gli sviluppatori costruiscono il server di sicurezza IA che valuta ogni richiesta.
Poiché l'hook viene eseguito sui server di Anthropic, dopo che la richiesta lascia il client e prima che il modello venga eseguito, si applica uniformemente a ogni richiesta governata, senza nulla da installare o distribuire sui dispositivi degli utenti.
Attualmente l'unico evento hook è prompt, che si attiva una volta per ogni richiesta di inferenza governata, prima che l'inferenza inizi. L'applicazione lato risposta è pianificata come evento successivo.
POST all'endpoint del server di sicurezza IA configurato dalla tua organizzazione. Il corpo della richiesta contiene la trascrizione della conversazione, e ogni richiesta è firmata secondo la specifica Standard Webhooks una volta che la tua organizzazione genera il proprio segreto di firma, così il tuo server può verificare che provenga da Anthropic.allow, l'inferenza procede normalmente. In caso di deny, la richiesta viene rifiutata e l'utente vede un messaggio di blocco per policy composto da due parti: il motivo specifico della richiesta fornito dal tuo server di sicurezza IA nel campo deny_reason del verdetto, seguito da un messaggio permanente configurato dai tuoi amministratori (ad esempio, chi contattare o dove richiedere un'eccezione). Se i tuoi amministratori non ne hanno configurato uno, un messaggio predefinito integrato indirizza l'utente a contattarli. Ogni rifiuto viene anche registrato nell'Activity Feed della tua organizzazione.Il diagramma seguente traccia un esempio (una richiesta Cowork in cui Claude chiama anche uno strumento O365) per illustrare quali parti del flusso sono intercettate dagli hook. I punti intercettati sono i passaggi 1 e 5 del diagramma, dove arriva il prompt e ritorna il risultato dello strumento; ciascuno produce lo scambio di validazione con il tuo server di sicurezza IA mostrato nei passaggi 2 e 6.
Un verdetto è un piccolo oggetto JSON: {"action": "allow"} consente alla richiesta di procedere, mentre un deny contiene il motivo visibile all'utente. Per lo schema completo del verdetto, consulta Restituire un verdetto.
Il tuo server di sicurezza IA vede ciò che vede l'utente: testo della trascrizione, chiamate agli strumenti e relativi risultati, e testo estratto dagli allegati. Non riceve mai byte grezzi di file o immagini, prompt di sistema o contesto interno di Anthropic.
Se il tuo server di sicurezza IA non è raggiungibile, restituisce un errore o non risponde entro il timeout, l'impostazione di gestione degli errori della tua organizzazione decide l'esito: bloccare la richiesta o consentirle di procedere senza ispezione.
L'applicazione può essere distribuita al tuo ritmo, così nessuno deve essere bloccato dal primo giorno: la modalità shadow osserva i verdetti sul traffico reale senza bloccare nulla, una percentuale di rollout ispeziona una frazione scelta di richieste, e le esclusioni esentano completamente i membri dei ruoli scelti. Consulta Configurare gli Inference hooks.
Per gli schemi completi di richiesta e risposta, la verifica della firma e i dettagli operativi, consulta Sviluppare un'integrazione.
allow, come alternativa basata su push al polling della Compliance API.Gli Inference hooks sono disponibili per le organizzazioni Claude Enterprise. La loro configurazione richiede il permesso organization:manage, che i ruoli predefiniti Admin, Owner e Primary owner possiedono, così come qualsiasi ruolo personalizzato a cui sia stato concesso.
Un unico hook governa le conversazioni su claude.ai, Cowork e le sessioni Claude Code nella tua organizzazione Claude Enterprise, sia che vengano eseguite sul web, nell'app desktop o nella CLI. Gli Inference hooks non sono disponibili su Amazon Bedrock o Google Cloud.
Le richieste governate sono le richieste di inferenza alla base della conversazione dell'utente. Le richieste accessorie, come la generazione del titolo della conversazione, non vengono inviate al tuo endpoint, e i prompt di sistema e le definizioni degli strumenti non sono mai inclusi in ciò che viene inviato. La modalità vocale non è coperta.
Entrambe le funzionalità servono i team di sicurezza, legali e di conformità nelle organizzazioni Claude Enterprise.
| Inference hooks | Compliance API | |
|---|---|---|
| Quando agisce | In linea, prima che l'inferenza venga eseguita | A posteriori |
| Cosa fa | Autorizza o rifiuta ogni richiesta governata in tempo reale | Recupera attività, chat, file, progetti, trascrizioni di sessioni Cowork e Claude Code, e utenti per audit ed esportazione |
| Direzione | Anthropic chiama il tuo server di sicurezza IA | Tu chiami l'API di Anthropic |
Usa gli Inference hooks per fermare una richiesta prima che raggiunga il modello, e la Compliance API per verificare cosa è successo in seguito.
Abilita gli Inference hooks per la tua organizzazione, configura e testa il tuo server di sicurezza IA, scegli la gestione degli errori e applica i verdetti.
Gli schemi di richiesta e verdetto, la verifica della firma, la semantica operativa e i pattern di integrazione per costruire il server di sicurezza IA.
Was this page helpful?