Inference hooks konfigurieren
Lasse Inference hooks für deine Claude Enterprise-Organisation zu, verbinde deinen KI-Sicherheitsserver und steuere Durchsetzung, Fehlerbehandlung und Rollout.
„Inference hooks“ (Inferenz-Hooks) senden Prompts aus deiner Organisation an einen „AI security server“ (KI-Sicherheitsserver) deiner Wahl und halten jede Anfrage zurück, bis ein „verdict“ (Entscheidung), also ein Allow- oder Deny-Verdict, vorliegt, bevor Claude sie verarbeitet. Diese Seite führt dich durch das Einschalten der Funktion, das Verbinden deines Servers und das Steuern der Durchsetzung. Um zu erfahren, was Inference hooks sind und wann du sie einsetzen solltest, siehe die Übersicht zu Inference hooks. Um den KI-Sicherheitsserver selbst zu bauen, siehe Eine Inference hooks-Integration entwickeln.
Bevor du beginnst
Du benötigst:
- Die Berechtigung
organization:managein claude.ai. Die integrierten Rollen Admin, Inhaber und Primärer Inhaber verfügen darüber, ebenso wie jede benutzerdefinierte Rolle, der sie gewährt wurde. - Einen HTTPS-Endpunkt eines KI-Sicherheitsservers, der Verdict-Anfragen entgegennimmt: eine
https://-URL auf Port 443, auf einem öffentlich routbaren Host, ohne Weiterleitungen erreichbar. Reverse-Tunnel-Hosts (ngrok und ähnliche Tunnel-Dienste) werden nicht unterstützt: Die Netzwerkrichtlinie von Anthropic blockiert sie. Teste nicht über einen Tunnel; hoste deinen Server auf einer Domain, die du kontrollierst. Die vollständigen Hosting-Anforderungen sowie Informationen zum Bau des Servers und zur Verifizierung signierter Anfragen findest du unter Eine Inference hooks-Integration entwickeln.
Inference hooks einrichten
Es gibt drei Durchsetzungszustände: aus (Verdicts durchsetzen ist aus: Dein KI-Sicherheitsserver wird nie kontaktiert und Prompts werden nicht geprüft), Shadow (Verdicts durchsetzen ist an und Modus ist auf Shadow-Modus gesetzt: Dein KI-Sicherheitsserver empfängt Prompts und gibt Verdicts zurück, und nichts wird blockiert) und durchsetzend (Verdicts durchsetzen ist an und Modus ist auf Anfrage zulassen oder Anfrage blockieren gesetzt: Ein Deny blockiert die Anfrage). Die folgenden Schritte führen eine neue Konfiguration von aus zu durchsetzend.
Inference hooks für deine Organisation zulassen
Gehe zu claude.ai > Organisationseinstellungen > Daten und Datenschutz und suche den Abschnitt Inference hooks. Schalte Für deine Organisation zulassen ein.
Das Einschalten schaltet die Einstellungsseite für Inference hooks frei und erzwingt stets, dass Verdicts durchsetzen aus ist, sodass das Zulassen der Funktion nie von selbst eine Prüfung startet: Selbst eine Konfiguration, bei der die Durchsetzung zuvor eingeschaltet war, bleibt ungeprüft, bis du Verdicts durchsetzen im letzten Schritt wieder einschaltest.
Die Einstellungsseite für Inference hooks öffnen
Öffne weiterhin unter Daten und Datenschutz den Abschnitt Inference hooks, um zur Einstellungsseite für Inference hooks zu gelangen. Sie befindet sich unter Daten und Datenschutz und nicht als eigener Eintrag in der Einstellungsnavigation, daher lautet ihr Breadcrumb Daten und Datenschutz / Inference hooks. Bis du einen Endpunkt speicherst, warnt die Seite, dass Prompts noch nicht geprüft werden, und Verdicts durchsetzen bleibt aus mit einem Badge Endpunkt erforderlich.
Deinen Endpunkt konfigurieren
Klicke auf Konfigurieren, um den Dialog Endpunkt konfigurieren zu öffnen, und fülle Folgendes aus:
- Endpunkt-URL: die
https://-URL, die Verdict-Anfragen empfängt. Es werden nurhttps://-URLs akzeptiert. - Benutzerdefinierte Anfrage-Header: bis zu 16 statische Header, die mit jeder Verdict-Anfrage gesendet werden, damit dein KI-Sicherheitsserver den Aufrufer authentifizieren kann. Header-Werte werden verschlüsselt gespeichert und nie wieder angezeigt; nach dem Speichern werden nur die Header-Namen angezeigt. Da Werte nur schreibbar sind, erfordert das Speichern jeder Änderung an den Headern die erneute Eingabe aller Werte. Das Ändern der Endpunkt-URL löscht alle gespeicherten Header-Werte, sodass deine Zugangsdaten nie an ein neues Ziel gesendet werden; gib sie nach einer URL-Änderung erneut ein. Header-Namen müssen Standard-HTTP-Token-Zeichen mit
-statt_verwenden und dürfen nicht mit reservierten Namen kollidieren (Request-Framing-Header wieContent-*undHost, Proxy- und Cookie-Header, Client-Adress-Header wieX-Forwarded-*, diewebhook-*-Signatur-Header und das PräfixX-Anthropic-*). Werte müssen druckbares ASCII sein.
Der Dialog umfasst nur diese beiden Felder plus Verbindung testen; er fragt nicht nach der Fehlerbehandlung, die du in Schritt 6 wählst. Sobald ein Endpunkt gespeichert ist, lautet die Schaltfläche Bearbeiten.
- Endpunkt-URL: die
Die Verbindung testen
Klicke auf Verbindung testen. Claude sendet einen synthetischen Test-Prompt an die URL und die Header, die aktuell im Formular stehen, nicht an die gespeicherten Werte; gib daher alle gespeicherten Header-Werte vor dem Testen erneut ein. Bei Erfolg meldet das Ergebnis, ob dein KI-Sicherheitsserver für den Test-Prompt ein Allow- oder ein Deny-Verdict zurückgegeben hat, wodurch ein Alles-ablehnen-Standard sichtbar wird, bevor du mit der Durchsetzung beginnst.
Häufige Fehlerergebnisse:
Ergebnis Was zu prüfen ist URL abgelehnt Die URL hat eine strukturelle Prüfung nicht bestanden. Verwende eine https://-URL auf Port 443.Private oder interne IP Der Host wird zu einer privaten oder internen Adresse aufgelöst. Verwende einen öffentlich routbaren Host. Timeout Der KI-Sicherheitsserver hat innerhalb des Timeouts kein Verdict zurückgegeben. Transportfehler Die DNS-Auflösung, der TLS-Handshake oder die Verbindung ist fehlgeschlagen. Status ungleich 200 Der KI-Sicherheitsserver hat mit einem anderen Status als 200 geantwortet. Verdicts müssen als HTTP 200 zurückkommen; Weiterleitungen werden nicht verfolgt und zählen als Fehler. Nicht parsbare Antwort Der KI-Sicherheitsserver hat geantwortet, aber der Body ist kein gültiges Verdict. Speichern und dein Signaturgeheimnis aufbewahren
Speichere die Endpunktkonfiguration. Das erste Speichern erzeugt dein „webhook signing secret“ (Webhook-Signaturgeheimnis) und zeigt es einmalig an. Kopiere es und bewahre es sicher auf, bevor du den Dialog schließt: Das Geheimnis kann später nicht mehr abgerufen, sondern nur rotiert werden.
Dein KI-Sicherheitsserver verwendet dieses Geheimnis, um die Signatur jeder empfangenen Anfrage zu verifizieren. Das Verifizierungsverfahren findest du unter Die Signatur verifizieren.
Fehlerbehandlung und Timeout wählen
Setze unter Fehlerbehandlung den Modus, um festzulegen, was passiert, während der KI-Sicherheitsserver nicht erreichbar ist oder Verdicts das Timeout überschreiten:
- Anfrage blockieren: Inferenz stoppen, wenn dein KI-Sicherheitsserver kein Verdict liefern kann (fail closed).
- Anfrage zulassen: die Anfrage ohne Prüfung zum Modell weiterleiten (fail open).
Die dritte Option des Dropdowns, Shadow-Modus, ist ein Rollout-Werkzeug und keine Fehlerrichtlinie; siehe Shadow-Modus.
Setze dann Timeout für Prompt-Verdict (ms): 1 bis 10.000 ms, mit einem Standardwert von 5.000 ms. Das Budget deckt den gesamten Austausch ab, und ein langsameres Verdict zählt als nicht erreichbarer Server; setze daher den niedrigsten Wert, den dein Server zuverlässig einhalten kann.
Änderungen in diesem Abschnitt werden gespeichert, sobald du sie vornimmst. Beim ersten Speichern sind die Standardwerte Anfrage zulassen und 5.000 ms.
Einen Rollout-Prozentsatz wählen
Setze unter Rollout den Wert Geprüfte Anfragen (%), um die Prüfung für einen Prozentsatz der Anfragen auszuführen, während du deinen KI-Sicherheitsserver in Betrieb nimmst. Der Wert reicht von 0 bis 100: 100 prüft alles, und 0 schaltet die Prüfung aus.
Jede Anfrage wird einmal für ihren gesamten Gesprächszug ausgelost, sodass ein einzelnes Gespräch über mehrere Züge hinweg teilweise geprüft werden kann. Anfragen außerhalb des ausgelosten Prozentsatzes werden ohne Prüfung fortgesetzt, selbst wenn die Fehlerbehandlung auf Anfrage blockieren gesetzt ist.
Verdicts durchsetzen einschalten
Um Verdicts gegen Live-Traffic zu evaluieren, ohne zunächst jemanden zu blockieren, setze Modus auf Shadow-Modus (Schritt 6), bevor du die Durchsetzung einschaltest; siehe Shadow-Modus.
Schalte Verdicts durchsetzen ein, um Claude für jeden abgedeckten Prompt vom Verdict deines KI-Sicherheitsservers abhängig zu machen, und bestätige dann im Dialog, der deine Wahl der Fehlerbehandlung erneut anzeigt. Rechne mit etwa einer Minute, bis die Änderung jeden Anthropic-Server erreicht; bereits laufende Anfragen werden unter der alten Einstellung abgeschlossen. Das Ausschalten stoppt das Senden von Prompts an deinen KI-Sicherheitsserver, ebenfalls innerhalb von etwa einer Minute; deine Konfiguration bleibt erhalten.
Shadow-Modus
Der Shadow-Modus führt deinen Hook gegen Live-Traffic aus, ohne etwas zu blockieren. Dein KI-Sicherheitsserver empfängt abgedeckte Prompts und gibt Verdicts genau so zurück, wie er es bei der Durchsetzung tun würde, aber nichts wird blockiert: Jede Anfrage wird zum Modell weitergeleitet, selbst wenn dein Server sie ablehnt oder nicht erreichbar ist, und der Endnutzer sieht nichts davon. Nutze ihn, um deine Richtlinie gegen den echten Traffic deiner Organisation abzustimmen, bevor du mit der Durchsetzung beginnst.
Um den Shadow-Modus zu verwenden, setze unter Fehlerbehandlung den Modus auf Shadow-Modus und schalte dann Verdicts durchsetzen ein, damit Prompts zu deinem KI-Sicherheitsserver fließen. Solange er aktiv ist, zeigt die Einstellungsseite ein Badge Shadow-Modus — keine Blockierung. Um den Shadow-Modus zu verlassen, setze Modus zurück auf Anfrage zulassen oder Anfrage blockieren; Verdicts werden wieder durchgesetzt, sobald die Durchsetzung eingeschaltet ist.
Ausschlüsse
Wähle unter Ausschlüsse Rollen aus, deren Mitglieder nicht von Inference hooks abgedeckt werden: Ihre Prompts werden nie an deinen KI-Sicherheitsserver gesendet. Nur benutzerdefinierte Rollen, die deine Organisation erstellt hat, können ausgeschlossen werden; die integrierten Rollen werden nicht angeboten. Wähle sie in der Rollenauswahl aus, deren Platzhalter Auszuschließende Rollen auswählen lautet, und verwalte auf der Rollen-Adminseite (Rollen verwalten), wer welche Rolle innehat; das Ändern von Ausschlüssen erfordert die Berechtigung zur Identitätsverwaltung. Die Liste ist standardmäßig leer, und wenn keine Rollen ausgeschlossen sind, wird jede abgedeckte Anfrage geprüft.
Der Ausschluss gilt für die interaktiven Sitzungen eines Nutzers; Traffic, der mit Maschinen-Zugangsdaten authentifiziert ist, wird immer geprüft. Wenn Claude die Rollenzugehörigkeit eines Anfragenden nicht auflösen kann, schlägt die Anfrage fail closed mit einem wiederholbaren Fehler fehl, anstatt ungeprüft fortzufahren. Änderungen an der Ausschlussliste werden im Audit-Trail aufgezeichnet.
Benutzerdefinierte Nachricht für blockierte Prompts
Lege unter Benutzerdefinierte Nachricht für blockierte Prompts einen benutzerdefinierten Text von bis zu 500 Zeichen fest, der an den Fehler angehängt wird, den ein Endnutzer sieht, wenn dein KI-Sicherheitsserver eine Anfrage ablehnt (typischerweise, an wen man sich wenden oder wo man eine Ausnahme beantragen kann). Die endgültige Nachricht besteht aus dem anfragespezifischen deny_reason deines KI-Sicherheitsservers (falls vorhanden), einer Leerzeile und dann diesem Text. Ist kein benutzerdefinierter Text konfiguriert, weist ein integrierter Standardtext den Nutzer an, sich an seine Administratoren zu wenden; du kannst die angehängte Nachricht auch vollständig ausschalten, sodass der Nutzer nur den deny_reason sieht.
Deinen KI-Sicherheitsserver überwachen
Der Bereich zur Endpunktintegrität auf der Einstellungsseite für Inference hooks zeigt:
- Endpunktstatus: Fehlerfrei, Ausgelöst, Nicht durchsetzend oder Nicht konfiguriert, bevor ein Endpunkt gespeichert ist.
- Fehler pro Minute: Webhook-Fehler der letzten zwei Minuten, gemittelt.
- Blockierrate: Ablehnungen als Anteil an den Verdicts deines KI-Sicherheitsservers, angezeigt, solange der Rollout-Prozentsatz unter 100 liegt.
- Circuit Breaker ausgelöst: wann der Breaker zuletzt ausgelöst hat, falls er das getan hat.
- Letzte Fehler: Jeder Eintrag ist auf einen Zeitstempel, einen Fehlertyp und eine einzeilige Begründung reduziert. Einträge enthalten nie Anfrageinhalte oder deine Endpunkt-URL.
Das Panel arbeitet nach dem Best-Effort-Prinzip: Wenn Anthropic die Zähler nicht lesen kann, zeigt es null Fehler und keine Fehlereinträge statt eines eigenen Fehlers an, sodass ein fehlerfrei aussehendes Panel für sich allein kein Beweis dafür ist, dass dein KI-Sicherheitsserver fehlerfrei ist. Fehler pro Minute zählt jeden Fehler, einschließlich der Netzwerk- und DNS-Fehler, die den Circuit Breaker nie auslösen, sodass der Wert hoch sein kann, während Circuit Breaker ausgelöst leer bleibt.
Circuit Breaker
Anhaltende Webhook-Fehler, die deinem KI-Sicherheitsserver zuzuschreiben sind, lösen den „circuit breaker“ (Schutzschalter) aus, der die Durchsetzung stoppt: Dein Server wird nicht mehr kontaktiert, und deine Wahl unter Fehlerbehandlung gilt für jede geprüfte Anfrage. Ist Anfrage blockieren ausgewählt, werden Nutzer in deiner Organisation blockiert, bis der Breaker zurückgesetzt wird. Wenn der Breaker auslöst, werden Administratoren außerdem im Benachrichtigungscenter von claude.ai benachrichtigt.
Jede Auslösung wird außerdem im Activity Feed deiner Organisation als Aktivität inference_hooks_circuit_breaker_tripped aufgezeichnet, sodass dein Sicherheitsteam oder dein Anbieter über bereits betriebenes Monitoring, etwa ein SIEM, das den Feed einliest, bei Auslösungen alarmieren kann. Pro Auslösung wird eine Aktivität aufgezeichnet, nicht eine pro betroffener Anfrage. Die Aufzeichnung erfordert, dass die Compliance API für deine Organisation aktiviert ist; siehe Die Compliance API einrichten.
Zur Wiederherstellung behebe das Problem am Server und schalte dann Verdicts durchsetzen wieder ein, um den Breaker zurückzusetzen.
Der Breaker kann sich auch von selbst zurücksetzen. Ab 10 Minuten nach der Auslösung testet Anthropic, ob sich dein Server erholt hat: Höchstens etwa einmal pro Minute wird eine Anfrage aus dem normalen Traffic deiner Organisation zur Prüfung an deinen Server gesendet, und diese Anfrage wird für ihren Nutzer fortgesetzt, unabhängig davon, ob dein Server antwortet. Antwortet dein Server mit einem gültigen Verdict, Allow oder Deny, wird der Breaker zurückgesetzt und die Durchsetzung wieder aufgenommen. Jedes andere Ergebnis ist ein Webhook-Fehler: Der Breaker bleibt ausgelöst und das Testen geht weiter.
Die automatische Wiederherstellung läuft nur, solange deine Inference hooks-Einstellungen seit der Auslösung unverändert sind. Wenn du nach einer Auslösung irgendeine Inference hooks-Einstellung änderst, einschließlich der Rotation des Signaturgeheimnisses, stoppt das Testen und der Breaker setzt sich nicht mehr von selbst zurück; schalte Verdicts durchsetzen wieder ein, wenn dein Server repariert ist. Die automatische Wiederherstellung gilt nur für Auslösungen: Wenn du Verdicts durchsetzen selbst ausschaltest, bleibt die Durchsetzung aus, bis du sie wieder einschaltest.
Dein Signaturgeheimnis rotieren
Klicke unter Anfragesignierung auf Secret rotieren, um dein Signaturgeheimnis zu ersetzen. Die Rotation ist eine sofortige Umstellung: Das neue Geheimnis wird erzeugt und einmalig angezeigt, das alte Geheimnis kann nicht mehr abgerufen werden, und keine Anfrage wird jemals mit beiden Geheimnissen signiert, sodass es keinen Überlappungszeitraum gibt, auf den du dich verlassen könntest.
Anfragen, die mit dem vorherigen Geheimnis signiert wurden, können nach der Rotation noch kurzzeitig eintreffen; Die Signatur verifizieren beschreibt, wie dein KI-Sicherheitsserver die Umstellung handhaben sollte.
Audit-Trail
Inference hooks-Aktivitäten werden im Activity Feed deiner Organisation aufgezeichnet: Konfigurationsänderungen, Ablehnungen, Circuit-Breaker-Auslösungen und Anfragen, die gemäß deiner Fehlerbehandlungseinstellung ohne Prüfung fortgesetzt wurden. Solange der Circuit Breaker ausgelöst ist, werden keine anfragespezifischen Inference hooks-Aktivitäten aufgezeichnet; die Auslösungsaktivität ist der Eintrag des Feeds für dieses Zeitfenster. Ablehnungseinträge tragen Kennungen, mit denen du jede Ablehnung dem passenden Eintrag in deinem eigenen System zuordnen kannst.
Inference hooks ausschalten
Es gibt zwei Stufen von aus:
- Verdicts durchsetzen aus, auf der Einstellungsseite für Inference hooks: Innerhalb von etwa einer Minute werden keine Prompts aus deiner Organisation mehr an deinen KI-Sicherheitsserver gesendet; bereits laufende Anfragen werden unter der alten Einstellung abgeschlossen. Die Einstellungsseite bleibt verfügbar; nutze dies also, um die Durchsetzung zu pausieren, während du an deinem KI-Sicherheitsserver arbeitest.
- Für deine Organisation zulassen aus, in den Einstellungen unter Daten und Datenschutz: Prompts werden nicht mehr geprüft, und die Inference hooks-Einstellungen sind nicht mehr verfügbar, bis du es wieder einschaltest. Deine Endpunktkonfiguration, benutzerdefinierten Header und dein Signaturgeheimnis bleiben in beiden Fällen erhalten; das erneute Einschalten erzwingt, dass Verdicts durchsetzen aus ist, und setzt einen ausgelösten Circuit Breaker zurück, schalte die Durchsetzung also wieder ein, wenn du bereit bist.
Nächste Schritte
Baue den KI-Sicherheitsserver: die Anfrage- und Verdict-Schemas, die Signaturverifizierung und die Betriebssemantik.
Was Inference hooks sind, wie der Verdict-Roundtrip funktioniert und was an deinen KI-Sicherheitsserver gesendet wird.
Was this page helpful?