Les « Inference hooks » (hooks d'inférence) envoient les prompts de votre organisation à un serveur de sécurité IA de votre choix et retiennent chaque requête en attendant un verdict d'autorisation ou de refus avant que Claude ne la traite. Cette page explique comment activer la fonctionnalité, connecter votre serveur et contrôler l'application des verdicts. Pour comprendre ce que sont les Inference hooks et quand les utiliser, consultez la présentation des Inference hooks. Pour créer le serveur de sécurité IA lui-même, consultez Développer une intégration Inference hooks.
Vous avez besoin de :
organization:manage dans claude.ai. Les rôles intégrés Admin, Owner et Primary owner la détiennent, ainsi que tout rôle personnalisé auquel elle a été accordée.https:// sur le port 443, sur un hôte routable publiquement, accessible sans redirections. Pour les exigences d'hébergement complètes, et pour créer le serveur et vérifier les requêtes signées, consultez Développer une intégration Inference hooks.Il existe trois états d'application : désactivé (Enforce verdicts est désactivé : votre serveur de sécurité IA n'est jamais contacté et les prompts ne sont pas inspectés), shadow (Enforce verdicts est activé avec Mode défini sur Shadow mode : votre serveur de sécurité IA reçoit les prompts et renvoie des verdicts, mais rien n'est bloqué), et application active (Enforce verdicts est activé avec Mode défini sur Allow the request ou Block the request : un refus bloque la requête). Les étapes suivantes font passer une nouvelle configuration de l'état désactivé à l'application active.
Autoriser les Inference hooks pour votre organisation
Accédez à claude.ai > Organization settings > Data and privacy et trouvez la section Inference hooks. Activez Allow for your organization.
Cette activation déverrouille la page de paramètres des Inference hooks et force toujours Enforce verdicts à l'état désactivé, de sorte qu'autoriser la fonctionnalité ne démarre jamais l'inspection par elle-même : même une configuration dont l'application était précédemment activée reste non inspectée jusqu'à ce que vous réactiviez Enforce verdicts à l'étape finale.
Ouvrir la page de paramètres des Inference hooks
Toujours dans Data and privacy, ouvrez la section Inference hooks pour accéder à la page de paramètres des Inference hooks. Elle se trouve sous Data and privacy plutôt que comme entrée distincte dans la navigation des paramètres, de sorte que son fil d'Ariane indique Data and privacy / Inference hooks. Tant que vous n'avez pas enregistré de point de terminaison, la page avertit que les prompts ne sont pas encore inspectés, et Enforce verdicts reste désactivé avec un badge Requires endpoint.
Configurer votre point de terminaison
Cliquez sur Configure pour ouvrir la boîte de dialogue Configure endpoint et renseignez :
https:// qui reçoit les requêtes de verdict. Seules les URL https:// sont acceptées.- plutôt que _, et ne doivent pas entrer en conflit avec des noms réservés (en-têtes de cadrage de requête tels que Content-* et Host, en-têtes de proxy et de cookie, en-têtes d'adresse client tels que X-Forwarded-*, les en-têtes de signature webhook-* et le préfixe X-Anthropic-*). Les valeurs doivent être en ASCII imprimable.La boîte de dialogue ne couvre que ces deux champs plus Test connection ; elle ne demande pas la gestion des échecs, que vous choisissez à l'étape 6. Une fois un point de terminaison enregistré, le bouton indique Edit.
Tester la connexion
Cliquez sur Test connection. Claude envoie un prompt de test synthétique à l'URL et aux en-têtes actuellement saisis dans le formulaire, et non aux valeurs enregistrées ; ressaisissez donc toute valeur d'en-tête stockée avant de tester. En cas de succès, le résultat indique si votre serveur de sécurité IA a renvoyé un verdict d'autorisation ou de refus pour le prompt de test, ce qui révèle un comportement par défaut de refus systématique avant que vous ne commenciez à appliquer les verdicts.
Résultats d'échec courants :
| Résultat | Points à vérifier |
|---|---|
| URL rejetée | L'URL a échoué à une vérification structurelle. Utilisez une URL https:// sur le port 443. |
| IP privée ou interne | L'hôte se résout en une adresse privée ou interne. Utilisez un hôte routable publiquement. |
| Délai d'attente dépassé | Le serveur de sécurité IA n'a pas renvoyé de verdict dans le délai imparti. |
| Erreur de transport | La résolution DNS, la négociation TLS ou la connexion a échoué. |
| Statut non-200 | Le serveur de sécurité IA a répondu avec un statut autre que 200. Les verdicts doivent revenir en HTTP 200 ; les redirections ne sont pas suivies et comptent comme des échecs. |
| Réponse non analysable | Le serveur de sécurité IA a répondu, mais le corps n'est pas un verdict valide. |
Enregistrer et stocker votre secret de signature
Enregistrez la configuration du point de terminaison. Le premier enregistrement génère votre secret de signature de webhook et le révèle une seule fois. Copiez-le et stockez-le en lieu sûr avant de fermer la boîte de dialogue : le secret ne peut pas être récupéré ultérieurement, seulement renouvelé.
Votre serveur de sécurité IA utilise ce secret pour vérifier la signature de chaque requête qu'il reçoit. Pour la procédure de vérification, consultez Vérifier la signature.
Choisir la gestion des échecs et le délai d'attente
Sous Failure handling, définissez Mode pour choisir ce qui se passe lorsque le serveur de sécurité IA est inaccessible ou que les verdicts dépassent le délai d'attente :
La troisième option du menu déroulant, Shadow mode, est un outil de déploiement plutôt qu'une politique d'échec ; voir Shadow mode.
Définissez ensuite Prompt verdict timeout (ms) : de 1 à 10 000 ms, avec une valeur par défaut de 5 000 ms. Ce budget couvre l'échange complet, et un verdict plus lent compte comme un serveur inaccessible ; définissez donc la valeur la plus basse que votre serveur peut respecter de manière fiable.
Les modifications dans cette section sont enregistrées au fur et à mesure. Au premier enregistrement, les valeurs par défaut sont Allow the request et 5 000 ms.
Choisir un pourcentage de déploiement
Sous Rollout, définissez Requests inspected (%) pour exécuter l'inspection sur un pourcentage de requêtes pendant que vous mettez en place votre serveur de sécurité IA. La valeur va de 0 à 100 : 100 inspecte tout, et 0 désactive l'inspection.
Chaque requête est tirée au sort une seule fois pour l'ensemble de son tour de conversation, de sorte qu'une même conversation peut être partiellement inspectée d'un tour à l'autre. Les requêtes hors du pourcentage échantillonné se poursuivent sans inspection, même lorsque la gestion des échecs est définie sur Block the request.
Activer Enforce verdicts
Pour évaluer les verdicts sur le trafic réel sans bloquer personne au départ, définissez Mode sur Shadow mode (étape 6) avant d'activer l'application ; voir Shadow mode.
Activez Enforce verdicts pour conditionner Claude au verdict de votre serveur de sécurité IA pour chaque prompt gouverné, puis confirmez dans la boîte de dialogue, qui rappelle votre choix de gestion des échecs. Prévoyez environ une minute pour que le changement atteigne tous les serveurs Anthropic ; les requêtes déjà en cours se terminent sous l'ancien paramètre. La désactivation arrête l'envoi des prompts à votre serveur de sécurité IA, là encore dans un délai d'environ une minute ; votre configuration est conservée.
Le « shadow mode » (mode fantôme) exécute votre hook sur le trafic réel sans rien bloquer. Votre serveur de sécurité IA reçoit les prompts gouvernés et renvoie des verdicts exactement comme il le ferait en mode d'application, mais rien n'est bloqué : chaque requête se poursuit vers le modèle, même lorsque votre serveur la refuse ou est inaccessible, et l'utilisateur final ne voit rien. Utilisez-le pour ajuster votre politique sur le trafic réel de votre organisation avant de commencer à appliquer les verdicts.
Pour utiliser le shadow mode, définissez Mode sur Shadow mode sous Failure handling, puis activez Enforce verdicts afin que les prompts soient transmis à votre serveur de sécurité IA. Tant qu'il est actif, la page de paramètres affiche un badge Shadow mode — not blocking. Pour quitter le shadow mode, redéfinissez Mode sur Allow the request ou Block the request ; les verdicts sont de nouveau appliqués dès que l'application est activée.
Sous Exclusions, sélectionnez les rôles dont les membres ne sont pas couverts par les Inference hooks : leurs prompts ne sont jamais envoyés à votre serveur de sécurité IA. Seuls les rôles personnalisés créés par votre organisation peuvent être exclus ; les rôles intégrés ne sont pas proposés. Choisissez-les dans le sélecteur de rôles, dont le texte indicatif indique Select roles to exclude, et gérez les titulaires de chaque rôle depuis la page d'administration des rôles (Manage roles) ; modifier les exclusions nécessite la permission de gestion des identités. La liste est vide par défaut, et sans aucun rôle exclu, chaque requête gouvernée est inspectée.
L'exclusion s'applique aux sessions interactives d'un utilisateur ; le trafic authentifié par des identifiants machine est toujours inspecté. Si Claude ne peut pas résoudre l'appartenance d'un demandeur à un rôle, la requête échoue de manière fermée avec une erreur réessayable plutôt que de se poursuivre sans inspection. Les modifications de la liste d'exclusion sont enregistrées dans la piste d'audit.
Sous Custom blocked prompt message, définissez un texte personnalisé de 500 caractères maximum qui est ajouté à l'erreur qu'un utilisateur final voit lorsque votre serveur de sécurité IA refuse une requête (généralement qui contacter ou où demander une exception). Le message final est le deny_reason par requête de votre serveur de sécurité IA (lorsqu'il est présent), une ligne vide, puis ce texte. Sans texte personnalisé configuré, un message par défaut intégré invite l'utilisateur à contacter ses administrateurs ; vous pouvez également désactiver entièrement le message ajouté afin que l'utilisateur ne voie que le deny_reason.
La zone d'état du point de terminaison de la page de paramètres des Inference hooks affiche :
Le panneau fonctionne au mieux des possibilités : si Anthropic ne peut pas lire les compteurs, il affiche zéro échec et aucune erreur plutôt qu'une erreur propre, de sorte qu'un panneau d'apparence saine n'est pas en soi une preuve que votre serveur de sécurité IA est sain. Failures per minute compte chaque échec, y compris les erreurs réseau et DNS qui ne déclenchent jamais le disjoncteur, de sorte qu'il peut être élevé alors que Circuit breaker tripped reste vide.
Des échecs de webhook soutenus attribuables à votre serveur de sécurité IA déclenchent le disjoncteur, ce qui arrête l'application : votre serveur n'est plus contacté, et votre choix de Failure handling s'applique à chaque requête inspectée. Avec Block the request sélectionné, les utilisateurs de votre organisation sont bloqués jusqu'à ce que vous interveniez. Lorsque le disjoncteur se déclenche, les administrateurs sont également notifiés dans le centre de notifications de claude.ai.
Pour rétablir le fonctionnement, corrigez le serveur, puis réactivez Enforce verdicts pour réinitialiser le disjoncteur.
Cliquez sur Rotate secret sous Request signing pour remplacer votre secret de signature. Le renouvellement est un basculement immédiat : le nouveau secret est généré et révélé une seule fois, l'ancien secret ne peut plus être récupéré, et aucune requête n'est jamais signée avec les deux secrets, de sorte qu'il n'y a aucune période de chevauchement sur laquelle compter.
Des requêtes signées avec le secret précédent peuvent encore arriver brièvement après le renouvellement ; Vérifier la signature explique comment votre serveur de sécurité IA doit gérer la transition.
L'activité des Inference hooks est enregistrée dans le flux d'activité de votre organisation : modifications de configuration, refus et requêtes qui se sont poursuivies sans inspection selon votre paramètre de gestion des échecs. Les enregistrements de refus portent des identifiants qui vous permettent de relier chaque refus à l'enregistrement correspondant dans votre propre système.
Il existe deux niveaux de désactivation :
Créez le serveur de sécurité IA : les schémas de requête et de verdict, la vérification de signature et la sémantique opérationnelle.
Ce que sont les Inference hooks, comment fonctionne l'aller-retour du verdict et ce qui est envoyé à votre serveur de sécurité IA.
Was this page helpful?