Les « Inference hooks » (hooks d'inférence) permettent à une organisation Claude Enterprise de router chaque prompt régi via un serveur de sécurité IA, un service HTTPS exploité par l'organisation ou son fournisseur de sécurité, avant l'exécution de l'inférence. Lorsqu'un utilisateur soumet un prompt, Anthropic envoie la transcription de la conversation à votre serveur de sécurité IA et attend un verdict d'autorisation ou de refus ; une requête refusée n'atteint jamais le modèle. Les équipes de sécurité et de conformité utilisent les Inference hooks pour appliquer les politiques de données en ligne, et les développeurs construisent le serveur de sécurité IA qui évalue chaque requête.
Comme le hook s'exécute sur les serveurs d'Anthropic, après que la requête a quitté le client et avant que le modèle ne s'exécute, il s'applique uniformément à chaque requête régie, sans rien à installer ni à déployer sur les appareils des utilisateurs.
Aujourd'hui, le seul événement de hook est prompt, qui se déclenche une fois par requête d'inférence régie, avant le début de l'inférence. L'application côté réponse est prévue comme un événement ultérieur.
POST au point de terminaison du serveur de sécurité IA configuré par votre organisation. Le corps de la requête contient la transcription de la conversation, et chaque requête est signée conformément à la spécification Standard Webhooks une fois que votre organisation a généré son secret de signature, afin que votre serveur puisse vérifier qu'elle provient bien d'Anthropic.allow, l'inférence se poursuit normalement. En cas de deny, la requête est rejetée et l'utilisateur voit un message de blocage par politique composé de deux parties : la raison spécifique à la requête fournie par votre serveur de sécurité IA dans le champ deny_reason du verdict, suivie d'un message permanent configuré par vos administrateurs (par exemple, qui contacter ou où demander une exception). Si vos administrateurs n'en ont pas configuré, un message par défaut intégré invite l'utilisateur à les contacter. Chaque refus est également enregistré dans le flux d'activité de votre organisation.Le diagramme suivant retrace un exemple (une requête Cowork où Claude appelle également un outil O365) pour illustrer quelles parties du flux sont interceptées par les hooks. Les points interceptés sont les étapes 1 et 5 du diagramme, où le prompt arrive et où le résultat de l'outil est renvoyé ; chacun donne lieu à l'échange de validation avec votre serveur de sécurité IA illustré aux étapes 2 et 6.
Un verdict est un petit objet JSON : {"action": "allow"} laisse la requête se poursuivre, et un refus contient la raison destinée à l'utilisateur. Pour le schéma complet du verdict, consultez Renvoyer un verdict.
Votre serveur de sécurité IA voit ce que l'utilisateur voit : le texte de la transcription, les appels d'outils et leurs résultats, et le texte extrait des pièces jointes. Il ne reçoit jamais les octets bruts des fichiers ou des images, les invites système, ni le contexte interne à Anthropic.
Si votre serveur de sécurité IA est inaccessible, renvoie une erreur ou ne répond pas dans le délai imparti, le paramètre de gestion des échecs de votre organisation détermine le résultat : bloquer la requête, ou la laisser se poursuivre sans inspection.
L'application peut être déployée à votre rythme, afin que personne ne soit bloqué dès le premier jour : le mode observation (shadow mode) observe les verdicts sur le trafic réel sans rien bloquer, un pourcentage de déploiement inspecte une fraction choisie des requêtes, et les exclusions exemptent entièrement les membres des rôles choisis. Consultez Configurer les Inference hooks.
Pour les schémas complets de requête et de réponse, la vérification de signature et les détails opérationnels, consultez Développer une intégration.
allow, comme alternative en mode push à l'interrogation de la Compliance API.Les Inference hooks sont disponibles pour les organisations Claude Enterprise. Leur configuration nécessite la permission organization:manage, que détiennent les rôles intégrés Admin, Owner et Primary owner, ainsi que tout rôle personnalisé auquel elle a été accordée.
Un seul hook régit les conversations sur claude.ai, Cowork et les sessions Claude Code dans votre organisation Claude Enterprise, qu'elles s'exécutent sur le web, dans l'application de bureau ou dans la CLI. Les Inference hooks ne sont pas disponibles sur Amazon Bedrock ni sur Google Cloud.
Les requêtes régies sont les requêtes d'inférence sous-jacentes à la conversation de l'utilisateur. Les requêtes auxiliaires, telles que la génération du titre de la conversation, ne sont pas envoyées à votre point de terminaison, et les invites système et les définitions d'outils ne sont jamais incluses dans ce qui est envoyé. Le mode vocal n'est pas couvert.
Ces deux fonctionnalités servent les équipes de sécurité, juridiques et de conformité des organisations Claude Enterprise.
| Inference hooks | Compliance API | |
|---|---|---|
| Moment d'action | En ligne, avant l'exécution de l'inférence | Après coup |
| Ce qu'elle fait | Autorise ou refuse chaque requête régie en temps réel | Récupère l'activité, les conversations, les fichiers, les projets, les transcriptions de sessions Cowork et Claude Code, et les utilisateurs à des fins d'audit et d'export |
| Direction | Anthropic appelle votre serveur de sécurité IA | Vous appelez l'API d'Anthropic |
Utilisez les Inference hooks pour arrêter une requête avant qu'elle n'atteigne le modèle, et la Compliance API pour auditer ce qui s'est passé ensuite.
Activez les Inference hooks pour votre organisation, configurez et testez votre serveur de sécurité IA, choisissez la gestion des échecs et appliquez les verdicts.
Les schémas de requête et de verdict, la vérification de signature, la sémantique opérationnelle et les modèles d'intégration pour construire le serveur de sécurité IA.
Was this page helpful?