Inference hooks konfigurieren
Lasse Inference hooks für deine Claude Enterprise-Organisation zu, verbinde deinen KI-Sicherheitsserver und steuere Durchsetzung, Fehlerbehandlung und Rollout.
„Inference hooks“ (Inferenz-Hooks) senden Prompts aus deiner Organisation an einen „AI security server“ (KI-Sicherheitsserver) deiner Wahl und halten jede Anfrage zurück, bis ein „verdict“ (Entscheidung), also ein Allow- oder Deny-Verdict, vorliegt, bevor Claude sie verarbeitet. Diese Seite führt dich durch das Einschalten der Funktion, das Verbinden deines Servers und das Steuern der Durchsetzung. Um zu erfahren, was Inference hooks sind und wann du sie einsetzen solltest, siehe die Übersicht zu Inference hooks. Um den KI-Sicherheitsserver selbst zu bauen, siehe Eine Inference hooks-Integration entwickeln.
Bevor du beginnst
Du benötigst:
- Die Berechtigung
organization:managein claude.ai, die nur die Rollen Owner und Primary owner besitzen. Die Rolle Admin hat sie nicht. - Einen HTTPS-Endpunkt für den KI-Sicherheitsserver, der Urteilsanfragen annimmt: eine
https://-URL auf Port 443, auf einem öffentlich routbaren Host, erreichbar ohne Weiterleitungen. Reverse-Tunnel-Hosts (ngrok und ähnliche Tunneldienste) werden nicht unterstützt: Die Netzwerkrichtlinie von Anthropic blockiert sie. Teste nicht über einen Tunnel; hoste deinen Server auf einer Domain, die du kontrollierst. Die vollständigen Hosting-Anforderungen sowie Informationen zum Erstellen des Servers und zum Verifizieren signierter Anfragen findest du unter Eine Inference hooks-Integration entwickeln.
Inference hooks einrichten
Es gibt drei Durchsetzungszustände: aus (Verdicts durchsetzen ist aus: Dein KI-Sicherheitsserver wird nie kontaktiert und Prompts werden nicht geprüft), Shadow (Verdicts durchsetzen ist an und Modus ist auf Shadow-Modus gesetzt: Dein KI-Sicherheitsserver empfängt Prompts und gibt Verdicts zurück, und nichts wird blockiert) und durchsetzend (Verdicts durchsetzen ist an und Modus ist auf Anfrage zulassen oder Anfrage blockieren gesetzt: Ein Deny blockiert die Anfrage). Die folgenden Schritte führen eine neue Konfiguration von aus zu durchsetzend.
Inference hooks für deine Organisation zulassen
Gehe zu claude.ai > Organisationseinstellungen > Daten und Datenschutz und suche den Abschnitt Inference hooks. Schalte Für deine Organisation zulassen ein.
Das Einschalten schaltet die Einstellungsseite für Inference hooks frei und erzwingt stets, dass Verdicts durchsetzen aus ist, sodass das Zulassen der Funktion nie von selbst eine Prüfung startet: Selbst eine Konfiguration, bei der die Durchsetzung zuvor eingeschaltet war, bleibt ungeprüft, bis du Verdicts durchsetzen im letzten Schritt wieder einschaltest.
Die Einstellungsseite für Inference hooks öffnen
Öffne weiterhin unter Daten und Datenschutz den Abschnitt Inference hooks, um zur Einstellungsseite für Inference hooks zu gelangen. Sie befindet sich unter Daten und Datenschutz und nicht als eigener Eintrag in der Einstellungsnavigation, daher lautet ihr Breadcrumb Daten und Datenschutz / Inference hooks. Bis du einen Endpunkt speicherst, warnt die Seite, dass Prompts noch nicht geprüft werden, und Verdicts durchsetzen bleibt aus mit einem Badge Endpunkt erforderlich.
Deinen Endpunkt konfigurieren
Klicke auf Configure, um den Dialog Set up endpoint zu öffnen, und gib die Endpoint URL ein: die
https://-URL, die Urteilsanfragen empfängt. Es werden nurhttps://-URLs akzeptiert.Der Dialog fragt an dieser Stelle nichts weiter ab: Benutzerdefinierte Anfrage-Header folgen in Schritt 5 und die Fehlerbehandlung in Schritt 6. Klicke auf Next, um zu speichern. Sobald ein Endpunkt gespeichert ist, lautet die Schaltfläche Edit.
Dein Signatur-Secret speichern
Beim ersten Speichern wird dein Webhook-„signing secret" (Signatur-Secret) generiert und einmalig angezeigt. Kopiere es und bewahre es sicher auf, bevor du auf Next klickst: Das Secret kann später nicht abgerufen, sondern nur rotiert werden.
Dein KI-Sicherheitsserver verwendet dieses Secret, um die Signatur jeder empfangenen Anfrage zu verifizieren, einschließlich des Verbindungstests im nächsten Schritt. Das Verifizierungsverfahren findest du unter Die Signatur verifizieren.
Anfrage-Header hinzufügen und die Verbindung testen
Ein Klick auf Next im Dialog für das Signatur-Secret öffnet den Endpunkt-Dialog erneut, jetzt mit zwei zusätzlichen Steuerelementen:
- Custom request headers: bis zu 16 statische Header, die mit jeder Urteilsanfrage gesendet werden, damit dein KI-Sicherheitsserver den Aufrufer authentifizieren kann. Header-Werte werden verschlüsselt gespeichert und nie wieder angezeigt; nach dem Speichern werden nur die Header-Namen angezeigt. Da Werte nur geschrieben werden können, erfordert das Speichern jeder Änderung an den Headern die erneute Eingabe aller Werte. Das Ändern der Endpunkt-URL löscht alle gespeicherten Header-Werte, damit deine Anmeldedaten nie an ein neues Ziel gesendet werden; gib sie nach einer URL-Änderung erneut ein. Header-Namen müssen Standard-HTTP-Token-Zeichen mit
-statt_verwenden und dürfen nicht mit reservierten Namen kollidieren (Request-Framing-Header wieContent-*undHost, Proxy- und Cookie-Header, Client-Adress-Header wieX-Forwarded-*, diewebhook-*-Signatur-Header und das PräfixX-Anthropic-*). Werte müssen druckbares ASCII sein. - Test connection: Claude sendet einen synthetischen Test-Prompt an die URL und die Header, die sich aktuell im Formular befinden, nicht an die gespeicherten Werte. Gib daher alle gespeicherten Header-Werte vor dem Testen erneut ein. Bei Erfolg meldet das Ergebnis, ob dein KI-Sicherheitsserver für den Test-Prompt ein Allow- oder ein Deny-Urteil zurückgegeben hat. So wird ein Standardverhalten, das alles ablehnt, sichtbar, bevor du mit der Durchsetzung beginnst.
Klicke auf Save, um eingegebene Header zu speichern.
Häufige Fehlerergebnisse:
Ergebnis Was zu prüfen ist URL abgelehnt Die URL hat eine strukturelle Prüfung nicht bestanden. Verwende eine https://-URL auf Port 443.Private oder interne IP Der Host wird zu einer privaten oder internen Adresse aufgelöst. Verwende einen öffentlich routbaren Host. Timeout Der KI-Sicherheitsserver hat innerhalb des Timeouts kein Urteil zurückgegeben. Transportfehler Die DNS-Auflösung, der TLS-Handshake oder die Verbindung ist fehlgeschlagen. Nicht-200-Status Der KI-Sicherheitsserver hat mit einem anderen Status als 200 geantwortet. Urteile müssen als HTTP 200 zurückkommen; Weiterleitungen werden nicht verfolgt und zählen als Fehler. Nicht parsbare Antwort Der KI-Sicherheitsserver hat geantwortet, aber der Body ist kein gültiges Urteil. Signatur-Secret erforderlich Deine Organisation hat kein Signatur-Secret, daher würde der Test unsigniert gesendet. Klicke unter Request signing auf Generate secret und teste dann erneut. - Custom request headers: bis zu 16 statische Header, die mit jeder Urteilsanfrage gesendet werden, damit dein KI-Sicherheitsserver den Aufrufer authentifizieren kann. Header-Werte werden verschlüsselt gespeichert und nie wieder angezeigt; nach dem Speichern werden nur die Header-Namen angezeigt. Da Werte nur geschrieben werden können, erfordert das Speichern jeder Änderung an den Headern die erneute Eingabe aller Werte. Das Ändern der Endpunkt-URL löscht alle gespeicherten Header-Werte, damit deine Anmeldedaten nie an ein neues Ziel gesendet werden; gib sie nach einer URL-Änderung erneut ein. Header-Namen müssen Standard-HTTP-Token-Zeichen mit
Fehlerbehandlung und Timeout wählen
Setze unter Fehlerbehandlung den Modus, um festzulegen, was passiert, während der KI-Sicherheitsserver nicht erreichbar ist oder Verdicts das Timeout überschreiten:
- Anfrage blockieren: Inferenz stoppen, wenn dein KI-Sicherheitsserver kein Verdict liefern kann (fail closed).
- Anfrage zulassen: die Anfrage ohne Prüfung zum Modell weiterleiten (fail open).
Die dritte Option des Dropdowns, Shadow-Modus, ist ein Rollout-Werkzeug und keine Fehlerrichtlinie; siehe Shadow-Modus.
Setze dann Timeout für Prompt-Verdict (ms): 1 bis 10.000 ms, mit einem Standardwert von 5.000 ms. Das Budget deckt den gesamten Austausch ab, und ein langsameres Verdict zählt als nicht erreichbarer Server; setze daher den niedrigsten Wert, den dein Server zuverlässig einhalten kann.
Änderungen in diesem Abschnitt werden gespeichert, sobald du sie vornimmst. Beim ersten Speichern sind die Standardwerte Anfrage zulassen und 5.000 ms.
Einen Rollout-Prozentsatz wählen
Setze unter Rollout den Wert Geprüfte Anfragen (%), um die Prüfung für einen Prozentsatz der Anfragen auszuführen, während du deinen KI-Sicherheitsserver in Betrieb nimmst. Der Wert reicht von 0 bis 100: 100 prüft alles, und 0 schaltet die Prüfung aus.
Jede Anfrage wird einmal für ihren gesamten Gesprächszug ausgelost, sodass ein einzelnes Gespräch über mehrere Züge hinweg teilweise geprüft werden kann. Anfragen außerhalb des ausgelosten Prozentsatzes werden ohne Prüfung fortgesetzt, selbst wenn die Fehlerbehandlung auf Anfrage blockieren gesetzt ist.
Verdicts durchsetzen einschalten
Um Verdicts gegen Live-Traffic zu evaluieren, ohne zunächst jemanden zu blockieren, setze Modus auf Shadow-Modus (Schritt 6), bevor du die Durchsetzung einschaltest; siehe Shadow-Modus.
Schalte Verdicts durchsetzen ein, um Claude für jeden abgedeckten Prompt vom Verdict deines KI-Sicherheitsservers abhängig zu machen, und bestätige dann im Dialog, der deine Wahl der Fehlerbehandlung erneut anzeigt. Rechne mit etwa einer Minute, bis die Änderung jeden Anthropic-Server erreicht; bereits laufende Anfragen werden unter der alten Einstellung abgeschlossen. Das Ausschalten stoppt das Senden von Prompts an deinen KI-Sicherheitsserver, ebenfalls innerhalb von etwa einer Minute; deine Konfiguration bleibt erhalten.
Shadow-Modus
Der Shadow-Modus führt deinen Hook gegen Live-Traffic aus, ohne etwas zu blockieren. Dein KI-Sicherheitsserver empfängt abgedeckte Prompts und gibt Verdicts genau so zurück, wie er es bei der Durchsetzung tun würde, aber nichts wird blockiert: Jede Anfrage wird zum Modell weitergeleitet, selbst wenn dein Server sie ablehnt oder nicht erreichbar ist, und der Endnutzer sieht nichts davon. Nutze ihn, um deine Richtlinie gegen den echten Traffic deiner Organisation abzustimmen, bevor du mit der Durchsetzung beginnst.
Um den Shadow-Modus zu verwenden, setze unter Fehlerbehandlung den Modus auf Shadow-Modus und schalte dann Verdicts durchsetzen ein, damit Prompts zu deinem KI-Sicherheitsserver fließen. Solange er aktiv ist, zeigt die Einstellungsseite ein Badge Shadow-Modus — keine Blockierung. Um den Shadow-Modus zu verlassen, setze Modus zurück auf Anfrage zulassen oder Anfrage blockieren; Verdicts werden wieder durchgesetzt, sobald die Durchsetzung eingeschaltet ist.
Ausschlüsse
Wähle unter Ausschlüsse Rollen aus, deren Mitglieder nicht von Inference hooks abgedeckt werden: Ihre Prompts werden nie an deinen KI-Sicherheitsserver gesendet. Nur benutzerdefinierte Rollen, die deine Organisation erstellt hat, können ausgeschlossen werden; die integrierten Rollen werden nicht angeboten. Wähle sie in der Rollenauswahl aus, deren Platzhalter Auszuschließende Rollen auswählen lautet, und verwalte auf der Rollen-Adminseite (Rollen verwalten), wer welche Rolle innehat; das Ändern von Ausschlüssen erfordert die Berechtigung zur Identitätsverwaltung. Die Liste ist standardmäßig leer, und wenn keine Rollen ausgeschlossen sind, wird jede abgedeckte Anfrage geprüft.
Die Ausnahme gilt für die interaktiven Sitzungen eines Benutzers; Traffic, der über Maschinen-Anmeldedaten authentifiziert wird, wird immer geprüft. Änderungen an der Ausnahmeliste werden im Audit-Trail aufgezeichnet.
Benutzerdefinierte Nachricht für blockierte Prompts
Lege unter Benutzerdefinierte Nachricht für blockierte Prompts einen benutzerdefinierten Text von bis zu 500 Zeichen fest, der an den Fehler angehängt wird, den ein Endnutzer sieht, wenn dein KI-Sicherheitsserver eine Anfrage ablehnt (typischerweise, an wen man sich wenden oder wo man eine Ausnahme beantragen kann). Die endgültige Nachricht besteht aus dem anfragespezifischen deny_reason deines KI-Sicherheitsservers (falls vorhanden), einer Leerzeile und dann diesem Text. Ist kein benutzerdefinierter Text konfiguriert, weist ein integrierter Standardtext den Nutzer an, sich an seine Administratoren zu wenden; du kannst die angehängte Nachricht auch vollständig ausschalten, sodass der Nutzer nur den deny_reason sieht.
Deinen KI-Sicherheitsserver überwachen
Der Bereich zur Endpunktintegrität auf der Einstellungsseite für Inference hooks zeigt:
- Endpunktstatus: Fehlerfrei, Ausgelöst, Nicht durchsetzend oder Nicht konfiguriert, bevor ein Endpunkt gespeichert ist.
- Fehler pro Minute: Webhook-Fehler der letzten zwei Minuten, gemittelt.
- Blockierrate: Ablehnungen als Anteil an den Verdicts deines KI-Sicherheitsservers, angezeigt, solange der Rollout-Prozentsatz unter 100 liegt.
- Circuit Breaker ausgelöst: wann der Breaker zuletzt ausgelöst hat, falls er das getan hat.
- Letzte Fehler: Jeder Eintrag ist auf einen Zeitstempel, einen Fehlertyp und eine einzeilige Begründung reduziert. Einträge enthalten nie Anfrageinhalte oder deine Endpunkt-URL.
Das Panel arbeitet nach dem Best-Effort-Prinzip: Wenn Anthropic die Zähler nicht lesen kann, zeigt es null Fehler und keine Fehlereinträge statt eines eigenen Fehlers an, sodass ein fehlerfrei aussehendes Panel für sich allein kein Beweis dafür ist, dass dein KI-Sicherheitsserver fehlerfrei ist. Fehler pro Minute zählt jeden Fehler, einschließlich der Netzwerk- und DNS-Fehler, die den Circuit Breaker nie auslösen, sodass der Wert hoch sein kann, während Circuit Breaker ausgelöst leer bleibt.
Circuit Breaker
Anhaltende Webhook-Fehler, die deinem KI-Sicherheitsserver zuzuschreiben sind, lösen den „circuit breaker“ (Schutzschalter) aus, der die Durchsetzung stoppt: Dein Server wird nicht mehr kontaktiert, und deine Wahl unter Fehlerbehandlung gilt für jede geprüfte Anfrage. Ist Anfrage blockieren ausgewählt, werden Nutzer in deiner Organisation blockiert, bis der Breaker zurückgesetzt wird. Wenn der Breaker auslöst, werden Administratoren außerdem im Benachrichtigungscenter von claude.ai benachrichtigt.
Jede Auslösung wird außerdem im Activity Feed deiner Organisation als Aktivität inference_hooks_circuit_breaker_tripped aufgezeichnet, sodass dein Sicherheitsteam oder dein Anbieter über bereits betriebenes Monitoring, etwa ein SIEM, das den Feed einliest, bei Auslösungen alarmieren kann. Pro Auslösung wird eine Aktivität aufgezeichnet, nicht eine pro betroffener Anfrage. Die Aufzeichnung erfordert, dass die Compliance API für deine Organisation aktiviert ist; siehe Die Compliance API einrichten.
Zur Wiederherstellung behebe das Problem am Server und schalte dann Verdicts durchsetzen wieder ein, um den Breaker zurückzusetzen.
Der Circuit Breaker kann sich auch selbst zurücksetzen. Ab 10 Minuten nach der Auslösung prüft Anthropic, ob sich dein Server erholt hat, indem im Hintergrund eine Testanfrage an ihn gesendet wird, höchstens etwa einmal pro Minute; dabei ist keine Benutzeranfrage beteiligt. Antwortet dein Server mit einem gültigen Urteil, Allow oder Deny, wird der Circuit Breaker zurückgesetzt und die Durchsetzung fortgesetzt. Andernfalls bleibt der Circuit Breaker ausgelöst und die Prüfungen werden fortgesetzt.
Die automatische Wiederherstellung läuft nur, solange deine Inference hooks-Einstellungen seit der Auslösung unverändert sind. Wenn du nach einer Auslösung eine Inference hooks-Einstellung änderst, einschließlich der Rotation des Signatur-Secrets, werden die Prüfungen beendet und der Circuit Breaker setzt sich nicht mehr selbst zurück; aktiviere Enforce verdicts erneut, sobald dein Server repariert ist. Die automatische Wiederherstellung gilt nur für Auslösungen: Wenn du Enforce verdicts selbst deaktivierst, bleibt die Durchsetzung deaktiviert, bis du sie wieder aktivierst.
Dein Signaturgeheimnis rotieren
Klicke unter Request signing auf Rotate secret, um dein Signatur-Secret zu ersetzen. Wenn deine Organisation noch kein Secret hat, lautet dieselbe Schaltfläche Generate secret und erstellt das erste. Die Rotation ist eine sofortige Umstellung: Das neue Secret wird generiert und einmalig angezeigt, das alte Secret kann nicht mehr abgerufen werden, und keine Anfrage wird jemals mit beiden Secrets signiert, sodass es keinen Überlappungszeitraum gibt, auf den du dich verlassen kannst.
Anfragen, die mit dem vorherigen Geheimnis signiert wurden, können nach der Rotation noch kurzzeitig eintreffen; Die Signatur verifizieren beschreibt, wie dein KI-Sicherheitsserver die Umstellung handhaben sollte.
Audit-Trail
Inference hooks-Aktivitäten werden im Activity Feed deiner Organisation aufgezeichnet: Konfigurationsänderungen, Ablehnungen, Circuit-Breaker-Auslösungen und Anfragen, die gemäß deiner Fehlerbehandlungseinstellung ohne Prüfung fortgesetzt wurden. Solange der Circuit Breaker ausgelöst ist, werden keine anfragespezifischen Inference hooks-Aktivitäten aufgezeichnet; die Auslösungsaktivität ist der Eintrag des Feeds für dieses Zeitfenster. Ablehnungseinträge tragen Kennungen, mit denen du jede Ablehnung dem passenden Eintrag in deinem eigenen System zuordnen kannst.
Inference hooks ausschalten
Es gibt zwei Stufen von aus:
- Verdicts durchsetzen aus, auf der Einstellungsseite für Inference hooks: Innerhalb von etwa einer Minute werden keine Prompts aus deiner Organisation mehr an deinen KI-Sicherheitsserver gesendet; bereits laufende Anfragen werden unter der alten Einstellung abgeschlossen. Die Einstellungsseite bleibt verfügbar; nutze dies also, um die Durchsetzung zu pausieren, während du an deinem KI-Sicherheitsserver arbeitest.
- Für deine Organisation zulassen aus, in den Einstellungen unter Daten und Datenschutz: Prompts werden nicht mehr geprüft, und die Inference hooks-Einstellungen sind nicht mehr verfügbar, bis du es wieder einschaltest. Deine Endpunktkonfiguration, benutzerdefinierten Header und dein Signaturgeheimnis bleiben in beiden Fällen erhalten; das erneute Einschalten erzwingt, dass Verdicts durchsetzen aus ist, und setzt einen ausgelösten Circuit Breaker zurück, schalte die Durchsetzung also wieder ein, wenn du bereit bist.
Nächste Schritte
Baue den KI-Sicherheitsserver: die Anfrage- und Verdict-Schemas, die Signaturverifizierung und die Betriebssemantik.
Was Inference hooks sind, wie der Verdict-Roundtrip funktioniert und was an deinen KI-Sicherheitsserver gesendet wird.
Was this page helpful?