Claude Platform Docs
管理推論フック

Inference hooksを設定する

Claude Enterprise組織でInference hooksを許可し、AIセキュリティサーバーを接続して、適用、障害処理、ロールアウトを制御します。

Inference hooksは、組織からのプロンプトを選択したAIセキュリティサーバーに送信し、Claudeが処理する前に各リクエストを許可または拒否の「verdict」(判定)が出るまで保留します。このページでは、機能の有効化、サーバーの接続、適用の制御について順を追って説明します。Inference hooksとは何か、いつ使用すべきかについては、Inference hooksの概要を参照してください。AIセキュリティサーバー自体を構築するには、Inference hooksインテグレーションを開発するを参照してください。

始める前に

以下が必要です。

  • claude.aiにおけるorganization:manage権限。組み込みのAdminOwnerPrimary ownerロールがこの権限を保持しているほか、この権限を付与された任意のカスタムロールも保持しています。
  • 判定リクエストを受け付けるAIセキュリティサーバーのHTTPSエンドポイント。ポート443上のhttps:// URLで、パブリックにルーティング可能なホスト上にあり、リダイレクトなしで到達可能である必要があります。リバーストンネルホスト(ngrokおよび類似のトンネルサービス)はサポートされていません。Anthropicのネットワークポリシーによってブロックされます。トンネル経由でテストしないでください。自分が管理するドメインでサーバーをホストしてください。完全なホスティング要件、およびサーバーの構築と署名付きリクエストの検証については、Inference hooksインテグレーションを開発するを参照してください。

Inference hooksをセットアップする

適用状態には3つあります。オフEnforce verdictsがオフ:AIセキュリティサーバーには一切接続されず、プロンプトは検査されません)、シャドウEnforce verdictsがオンでModeShadow modeに設定されている:AIセキュリティサーバーはプロンプトを受信して判定を返しますが、何もブロックされません)、適用中Enforce verdictsがオンでModeAllow the requestまたはBlock the requestに設定されている:拒否によりリクエストがブロックされます)です。以下の手順では、新しい設定をオフから適用中まで進めます。

  1. 組織でInference hooksを許可する

    claude.ai > Organization settings > Data and privacyに移動し、Inference hooksセクションを見つけます。Allow for your organizationをオンにします。

    これをオンにするとInference hooks設定ページのロックが解除され、常にEnforce verdictsが強制的にオフになります。そのため、機能を許可しただけで検査が開始されることはありません。以前に適用がオンになっていた設定であっても、最後の手順でEnforce verdictsを再度オンにするまで検査されないままです。

  2. Inference hooks設定ページを開く

    引き続きData and privacyで、Inference hooksセクションを開いてInference hooks設定ページに移動します。このページは設定ナビゲーションの独立した項目ではなくData and privacyの下にあるため、パンくずリストにはData and privacy / Inference hooksと表示されます。エンドポイントを保存するまで、ページにはプロンプトがまだ検査されていないという警告が表示され、Enforce verdictsRequires endpointバッジ付きでオフのままです。

  3. エンドポイントを設定する

    ConfigureをクリックしてConfigure endpointダイアログを開き、以下を入力します。

    • Endpoint URL: 判定リクエストを受信するhttps:// URL。https:// URLのみ受け付けられます。
    • Custom request headers: AIセキュリティサーバーが呼び出し元を認証できるよう、すべての判定リクエストとともに送信される最大16個の静的ヘッダー。ヘッダー値は暗号化されて保存され、二度と表示されません。保存後はヘッダー名のみが表示されます。値は書き込み専用であるため、ヘッダーへの変更を保存するにはすべての値を再入力する必要があります。エンドポイントURLを変更すると、認証情報が新しい宛先に送信されることがないよう、保存されているすべてのヘッダー値がクリアされます。URL変更後は再入力してください。ヘッダー名は_ではなく-を使った標準のHTTPトークン文字を使用する必要があり、予約名(Content-*Hostなどのリクエストフレーミングヘッダー、プロキシおよびCookieヘッダー、X-Forwarded-*などのクライアントアドレスヘッダー、webhook-*署名ヘッダー、X-Anthropic-*プレフィックス)と衝突してはなりません。値は印字可能なASCIIである必要があります。

    ダイアログが扱うのはこれら2つのフィールドとTest connectionのみです。障害処理については尋ねられず、これは手順6で選択します。エンドポイントが保存されると、ボタンの表示はEditになります。

  4. 接続をテストする

    Test connectionをクリックします。Claudeは、保存済みの値ではなく現在フォームに入力されているURLとヘッダーに対して合成テストプロンプトを送信するため、テスト前に保存済みのヘッダー値を再入力してください。成功すると、結果にはAIセキュリティサーバーがテストプロンプトに対して許可または拒否のどちらの判定を返したかが報告されます。これにより、適用を開始する前にすべてを拒否するデフォルト設定が明らかになります。

    よくある失敗結果:

    結果確認事項
    URLが拒否されたURLが構造チェックに失敗しました。ポート443上のhttps:// URLを使用してください。
    プライベートまたは内部IPホストがプライベートまたは内部アドレスに解決されます。パブリックにルーティング可能なホストを使用してください。
    タイムアウトAIセキュリティサーバーがタイムアウト内に判定を返しませんでした。
    トランスポートエラーDNS解決、TLSハンドシェイク、または接続が失敗しました。
    200以外のステータスAIセキュリティサーバーが200以外のステータスで応答しました。判定はHTTP 200で返される必要があります。リダイレクトは追従されず、失敗として扱われます。
    解析不能なレスポンスAIセキュリティサーバーは応答しましたが、本文が有効な判定ではありません。
  5. 保存して署名シークレットを保管する

    エンドポイント設定を保存します。最初の保存時にWebhook署名シークレットが生成され、一度だけ表示されます。ダイアログを閉じる前にコピーして安全に保管してください。シークレットは後から取得できず、ローテーションのみ可能です。

    AIセキュリティサーバーは、受信するすべてのリクエストの署名を検証するためにこのシークレットを使用します。検証手順については、署名を検証するを参照してください。

  6. 障害処理とタイムアウトを選択する

    Failure handlingの下でModeを設定し、AIセキュリティサーバーに到達できない場合や判定がタイムアウトした場合の動作を選択します。

    • Block the request: AIセキュリティサーバーが判定を返せない場合に推論を停止します(フェイルクローズ)。
    • Allow the request: 検査なしでリクエストをモデルに進めます(フェイルオープン)。

    ドロップダウンの3番目のオプションであるShadow modeは、障害ポリシーではなくロールアウトツールです。シャドウモードを参照してください。

    次に**Prompt verdict timeout (ms)**を設定します。1〜10,000msで、デフォルトは5,000msです。この予算はやり取り全体をカバーし、これより遅い判定は到達不能なサーバーとして扱われるため、サーバーが確実に満たせる最小の値を設定してください。

    このセクションの変更は行うたびに保存されます。最初の保存時のデフォルトはAllow the requestと5,000msです。

  7. ロールアウト率を選択する

    Rolloutの下で**Requests inspected (%)**を設定し、AIセキュリティサーバーを立ち上げている間、一定割合のリクエストに対して検査を実行します。値の範囲は0〜100です。100はすべてを検査し、0は検査をオフにします。

    各リクエストは会話ターン全体に対して一度だけ抽選されるため、1つの会話がターンをまたいで部分的に検査されることがあります。サンプリング率の対象外となったリクエストは、障害処理がBlock the requestに設定されている場合でも検査なしで進みます。

  8. Enforce verdictsをオンにする

    最初は誰もブロックせずにライブトラフィックに対して判定を評価するには、適用をオンにする前にModeShadow modeに設定します(手順6)。シャドウモードを参照してください。

    Enforce verdictsをオンにすると、対象となるすべてのプロンプトについてAIセキュリティサーバーの判定でClaudeをゲートします。その後、障害処理の選択内容を再表示するダイアログで確認します。変更がすべてのAnthropicサーバーに反映されるまで約1分かかります。すでに処理中のリクエストは古い設定のもとで完了します。オフにすると、同様に約1分以内にプロンプトがAIセキュリティサーバーに送信されなくなります。設定は保持されます。

シャドウモード

「shadow mode」(シャドウモード)は、何もブロックせずにライブトラフィックに対してフックを実行します。AIセキュリティサーバーは適用時とまったく同じように対象プロンプトを受信して判定を返しますが、何もブロックされません。サーバーが拒否した場合や到達できない場合でも、すべてのリクエストがモデルに進み、エンドユーザーには何も表示されません。適用を開始する前に、組織の実際のトラフィックに対してポリシーを調整するために使用してください。

シャドウモードを使用するには、Failure handlingの下でModeShadow modeに設定し、次にEnforce verdictsをオンにしてプロンプトがAIセキュリティサーバーに流れるようにします。有効な間、設定ページにはShadow mode — not blockingバッジが表示されます。シャドウモードを終了するには、ModeAllow the requestまたはBlock the requestに戻します。適用がオンになると判定が再び適用されます。

除外

Exclusionsの下で、メンバーがInference hooksの対象外となるロールを選択します。そのメンバーのプロンプトはAIセキュリティサーバーに送信されません。除外できるのは組織が作成したカスタムロールのみで、組み込みロールは選択肢に表示されません。プレースホルダーにSelect roles to excludeと表示されているロールセレクターで選択し、各ロールの保持者はロール管理ページ(Manage roles)から管理します。除外の変更にはID管理権限が必要です。リストはデフォルトで空であり、除外されたロールがない場合、対象となるすべてのリクエストが検査されます。

除外はユーザーのインタラクティブセッションに適用されます。マシン認証情報で認証されたトラフィックは常に検査されます。Claudeがリクエスト元のロールメンバーシップを解決できない場合、リクエストは検査なしで進むのではなく、再試行可能なエラーでフェイルクローズします。除外リストへの変更は監査証跡に記録されます。

カスタムのブロック済みプロンプトメッセージ

Custom blocked prompt messageの下で、AIセキュリティサーバーがリクエストを拒否したときにエンドユーザーに表示されるエラーに追加される、最大500文字のカスタムテキストを設定します(通常は連絡先や例外申請先)。最終的なメッセージは、AIセキュリティサーバーのリクエストごとのdeny_reason(存在する場合)、空行、そしてこのテキストの順になります。カスタムテキストが設定されていない場合、組み込みのデフォルトがユーザーに管理者へ連絡するよう案内します。追加メッセージを完全にオフにして、ユーザーにdeny_reasonのみを表示することもできます。

AIセキュリティサーバーを監視する

Inference hooks設定ページのエンドポイントヘルスエリアには以下が表示されます。

  • Endpoint status: Healthy、Tripped、Not enforcing、またはエンドポイント保存前はNot configured。
  • Failures per minute: 直近2分間のWebhook失敗数の平均。
  • Block rate: AIセキュリティサーバーの判定に占める拒否の割合。ロールアウト率が100未満の間表示されます。
  • Circuit breaker tripped: ブレーカーが最後にトリップした時刻(トリップしたことがある場合)。
  • Recent errors: 各エントリはタイムスタンプ、エラータイプ、1行の理由に絞り込まれます。エントリにリクエスト内容やエンドポイントURLが含まれることはありません。

このパネルはベストエフォートです。Anthropicがカウンターを読み取れない場合、独自のエラーではなく失敗ゼロ・エラーなしと表示されるため、正常に見えるパネルだけではAIセキュリティサーバーが正常であることの証明にはなりません。Failures per minuteは、サーキットブレーカーをトリップさせることのないネットワークエラーやDNSエラーを含むすべての失敗をカウントするため、Circuit breaker trippedが空のままでも高い値になることがあります。

サーキットブレーカー

AIセキュリティサーバーに起因するWebhook失敗が継続すると「circuit breaker」(サーキットブレーカー)がトリップし、適用が停止します。サーバーには接続されなくなり、検査対象のすべてのリクエストにFailure handlingの選択が適用されます。Block the requestが選択されている場合、ブレーカーがリセットされるまで組織内のユーザーはブロックされます。ブレーカーがトリップすると、管理者にはclaude.aiの通知センターでも通知されます。

各トリップは組織のActivity Feedにもinference_hooks_circuit_breaker_trippedアクティビティとして記録されるため、セキュリティチームやベンダーは、フィードを取り込むSIEMなど、すでに運用している監視からトリップをアラートできます。アクティビティは影響を受けたリクエストごとではなく、トリップごとに1件記録されます。記録には組織でCompliance APIが有効になっている必要があります。Compliance APIをセットアップするを参照してください。

復旧するには、サーバーを修正してからEnforce verdictsを再度オンにしてブレーカーをリセットします。

ブレーカーは自動的にリセットされることもあります。トリップから10分後以降、Anthropicはサーバーが復旧したかどうかをテストします。最大で約1分に1回、組織の通常トラフィックから1件のリクエストが検査のためにサーバーに送信され、そのリクエストはサーバーが応答するかどうかにかかわらずユーザーのために進みます。サーバーが許可または拒否の有効な判定で応答すると、ブレーカーがリセットされ適用が再開されます。それ以外の結果はWebhook失敗となり、ブレーカーはトリップしたままでテストが継続されます。

自動復旧は、トリップ以降Inference hooks設定が変更されていない間のみ実行されます。トリップ後に署名シークレットのローテーションを含むInference hooks設定を変更すると、テストは停止し、ブレーカーは自動的にリセットされなくなります。サーバーが修正されたらEnforce verdictsを再度オンにしてください。自動復旧はトリップにのみ適用されます。自分でEnforce verdictsをオフにした場合、再度オンにするまで適用はオフのままです。

署名シークレットをローテーションする

Request signingの下のRotate secretをクリックして署名シークレットを置き換えます。ローテーションは即時切り替えです。新しいシークレットが生成されて一度だけ表示され、古いシークレットは取得できなくなり、両方のシークレットで署名されるリクエストは存在しないため、依存できる重複期間はありません。

以前のシークレットで署名されたリクエストがローテーション後も短時間届くことがあります。AIセキュリティサーバーが切り替えをどのように処理すべきかについては、署名を検証するで説明しています。

監査証跡

Inference hooksのアクティビティは組織のActivity Feedに記録されます。設定変更、拒否、サーキットブレーカーのトリップ、障害処理設定のもとで検査なしに進んだリクエストが対象です。サーキットブレーカーがトリップしている間、リクエストごとのInference hooksアクティビティは記録されません。トリップアクティビティがその期間のフィード上の記録となります。拒否レコードには、各拒否を自社システム内の対応するレコードと結合できる識別子が含まれます。

Inference hooksをオフにする

オフには2つのレベルがあります。

  • Inference hooks設定ページでのEnforce verdictsオフ:約1分以内に、組織からのプロンプトがAIセキュリティサーバーに送信されなくなります。すでに処理中のリクエストは古い設定のもとで完了します。設定ページは引き続き利用できるため、AIセキュリティサーバーの作業中に適用を一時停止するにはこれを使用してください。
  • Data and privacy設定でのAllow for your organizationオフ:プロンプトは検査されなくなり、再度オンにするまでInference hooks設定は利用できなくなります。いずれの場合もエンドポイント設定、カスタムヘッダー、署名シークレットは保持されます。再度オンにするとEnforce verdictsが強制的にオフになり、トリップしたサーキットブレーカーがクリアされるため、準備ができたら適用を再度オンにしてください。

次のステップ

AIセキュリティサーバーを構築します。リクエストと判定のスキーマ、署名検証、運用上のセマンティクス。

Inference hooksとは何か、判定のラウンドトリップの仕組み、AIセキュリティサーバーに送信される内容。

Was this page helpful?