Claude Platform Docs
AdministrationHooks d'inférence

Hooks d'inférence

Envoyez chaque prompt gouverné au serveur de sécurité IA de votre organisation pour obtenir un verdict d'autorisation ou de refus avant que l'inférence ne se poursuive.

Les « Inference hooks » (hooks d'inférence) permettent à une organisation Claude Enterprise d'acheminer chaque prompt gouverné via un « AI security server » (serveur de sécurité IA), un service HTTPS exploité par l'organisation ou son fournisseur de sécurité, avant l'exécution de l'inférence. Lorsqu'un utilisateur soumet un prompt, Anthropic envoie la transcription de la conversation à votre serveur de sécurité IA et attend un verdict d'autorisation ou de refus ; une requête refusée n'atteint jamais le modèle. Les équipes de sécurité et de conformité utilisent les hooks d'inférence pour appliquer des politiques de données en ligne, et les développeurs construisent le serveur de sécurité IA qui évalue chaque requête.

Comme le hook s'exécute sur les serveurs d'Anthropic, après que la requête a quitté le client et avant que le modèle ne s'exécute, il s'applique uniformément à chaque requête gouvernée, sans rien à installer ni à déployer sur les appareils des utilisateurs.

Aujourd'hui, le seul événement de hook est prompt, qui se déclenche une fois par requête d'inférence gouvernée, avant le début de l'inférence. L'application côté réponse est prévue comme événement ultérieur.


Fonctionnement des hooks d'inférence

  1. Un utilisateur soumet un prompt sur une surface gouvernée.
  2. Anthropic envoie une requête HTTPS POST au point de terminaison du serveur de sécurité IA configuré par votre organisation. Le corps de la requête contient la transcription de la conversation, et chaque requête est signée conformément à la spécification Standard Webhooks une fois que votre organisation a généré son secret de signature, afin que votre serveur puisse vérifier qu'elle provient bien d'Anthropic.
  3. Votre serveur de sécurité IA évalue le contenu et répond avec un verdict dans le délai d'expiration du verdict configuré par votre organisation (5 secondes par défaut).
  4. En cas de allow, l'inférence se poursuit normalement. En cas de deny, la requête est rejetée et l'utilisateur voit un message de blocage par politique assemblé à partir de deux parties : la raison propre à la requête fournie par votre serveur de sécurité IA dans le champ deny_reason du verdict, suivie d'un message permanent configuré par vos administrateurs (par exemple, qui contacter ou où demander une exception). Si vos administrateurs n'en ont pas configuré, un message par défaut intégré invite l'utilisateur à les contacter. Chaque refus est également enregistré dans le flux d'activité de votre organisation.

Le diagramme suivant retrace un exemple (une requête Cowork dans laquelle Claude appelle également un outil O365) pour illustrer quelles parties du flux sont soumises au hook. Les points soumis au hook sont les étapes 1 et 5 du diagramme, où le prompt arrive et où le résultat de l'outil revient ; chacun donne lieu à l'échange de validation avec votre « AI security server » (serveur de sécurité IA) illustré aux étapes 2 et 6.

Diagramme de flux : le « AI security server » (serveur de sécurité IA) valide à la fois le prompt et le « tool result » (résultat de l'outil) avant que l'inférence ne se poursuive

Un verdict est un petit objet JSON : {"action": "allow"} laisse la requête se poursuivre, et un refus contient la raison présentée à l'utilisateur. Pour le schéma complet du verdict, consultez Renvoyer un verdict.

Votre serveur de sécurité IA voit ce que l'utilisateur voit : le texte de la transcription, les appels d'outils et leurs résultats, ainsi que le texte extrait des pièces jointes. Il ne reçoit jamais les octets bruts des fichiers ou des images, les invites système ni le contexte interne à Anthropic. Anthropic ne stocke pas le contenu des prompts ou des réponses dans le cadre des hooks d'inférence ; seules les métadonnées relatives à l'activité des hooks sont enregistrées, telles que les verdicts, les horodatages et les identifiants de requête.

Si votre serveur de sécurité IA est injoignable, renvoie une erreur ou ne répond pas dans le délai imparti, le paramètre de gestion des échecs de votre organisation détermine l'issue : bloquer la requête ou l'autoriser à se poursuivre sans inspection.

L'application peut être déployée à votre rythme, de sorte que personne n'a à être bloqué dès le premier jour : le mode fantôme observe les verdicts sur le trafic réel sans rien bloquer, un pourcentage de déploiement inspecte une fraction choisie des requêtes, et des exclusions exemptent entièrement les membres de rôles choisis. Consultez Configurer les hooks d'inférence.

Pour les schémas complets de requête et de réponse, la vérification des signatures et les détails opérationnels, consultez Développer une intégration.


Cas d'utilisation

  • « Data loss prevention » (prévention des pertes de données), ou DLP. Transmettez la transcription à votre scanner DLP et refusez les prompts contenant des informations réglementées ou classifiées. Il s'agit du déploiement le plus courant.
  • Archivage des transcriptions en temps réel. Archivez chaque transcription à son arrivée et renvoyez toujours allow, comme alternative en mode push à l'interrogation de la Compliance API.
  • Télémétrie des prompts. Mesurez la façon dont votre organisation utilise Claude, au moment même de l'utilisation.
  • Moteurs de politiques. Appliquez vos propres règles avant l'inférence : listes d'autorisation de modèles, restrictions limitées à un projet ou contrôles des heures de travail.

Limitations actuelles

  • Les pièces jointes sont représentées par des métadonnées et du texte extrait. Les octets bruts des fichiers et des images ne sont jamais envoyés, de sorte que le contenu uniquement sous forme d'image (par exemple, une capture d'écran d'un document) n'est pas inspecté.
  • Les verdicts sont soit une autorisation, soit un refus. La réécriture ou la rédaction d'un prompt n'est pas prise en charge.
  • Les organisations de plateforme (accès API via la Claude Platform) sont hors du périmètre.

Disponibilité

Les hooks d'inférence sont disponibles pour les organisations Claude Enterprise. Leur configuration nécessite l'autorisation organization:manage, que détiennent les rôles intégrés Admin, Owner et Primary owner, ainsi que tout rôle personnalisé auquel elle a été accordée.

Un seul hook gouverne les conversations dans claude.ai, Cowork et les sessions Claude Code de votre organisation Claude Enterprise, qu'elles s'exécutent sur le web, dans l'application de bureau ou dans la CLI. Les hooks d'inférence ne sont pas disponibles sur Amazon Bedrock ni sur Google Cloud.

Les requêtes gouvernées sont les requêtes d'inférence sous-jacentes à la conversation de l'utilisateur. Les requêtes annexes, telles que la génération du titre de la conversation, ne sont pas envoyées à votre point de terminaison, et les invites système et les définitions d'outils ne sont jamais incluses dans ce qui est envoyé. Le mode vocal n'est pas couvert.


Hooks d'inférence et Compliance API

Les deux fonctionnalités servent les équipes de sécurité, juridiques et de conformité des organisations Claude Enterprise.

Hooks d'inférenceCompliance API
Moment d'actionEn ligne, avant l'exécution de l'inférenceAprès coup
Ce qu'elle faitAutorise ou refuse chaque requête gouvernée en temps réelRécupère l'activité, les chats, les fichiers, les projets, les transcriptions de sessions et les utilisateurs à des fins d'audit et d'export
DirectionAnthropic appelle votre serveur de sécurité IAVous appelez l'API d'Anthropic

Utilisez les hooks d'inférence pour arrêter une requête avant qu'elle n'atteigne le modèle, et la Compliance API pour auditer ce qui s'est passé par la suite.


Dans cette section

Autorisez les hooks d'inférence pour votre organisation, configurez et testez votre serveur de sécurité IA, choisissez la gestion des échecs et appliquez les verdicts.

Les schémas de requête et de verdict, la vérification des signatures, la sémantique opérationnelle et les modèles d'intégration pour construire le serveur de sécurité IA.

Was this page helpful?