Inference hooks 會將您組織的提示傳送至您選擇的 AI 安全伺服器,並在 Claude 處理每個請求之前,等待允許或拒絕的裁決。本頁面將逐步說明如何開啟此功能、連接您的伺服器,以及控制強制執行。如需了解 Inference hooks 是什麼以及何時使用,請參閱 Inference hooks 概述。如需建置 AI 安全伺服器本身,請參閱開發 Inference hooks 整合。
您需要:
organization:manage 權限。內建的 Admin、Owner 和 Primary owner 角色擁有此權限,任何被授予此權限的自訂角色也同樣擁有。https:// URL,位於可公開路由的主機上,且無需重新導向即可存取。如需完整的託管需求,以及如何建置伺服器和驗證已簽署的請求,請參閱開發 Inference hooks 整合。共有三種強制執行狀態:關閉(Enforce verdicts 關閉:永遠不會聯繫您的 AI 安全伺服器,且不會檢查提示)、影子模式(Enforce verdicts 開啟且 Mode 設為 Shadow mode:您的 AI 安全伺服器會接收提示並回傳裁決,但不會封鎖任何內容),以及強制執行(Enforce verdicts 開啟且 Mode 設為 Allow the request 或 Block the request:拒絕裁決會封鎖請求)。以下步驟將引導您將新設定從關閉狀態轉為強制執行狀態。
為您的組織允許 Inference hooks
前往 claude.ai > Organization settings > Data and privacy,找到 Inference hooks 區段。開啟 Allow for your organization。
開啟此選項會解鎖 Inference hooks 設定頁面,並一律強制將 Enforce verdicts 設為關閉,因此允許此功能本身絕不會啟動檢查:即使先前已開啟強制執行的設定,也會保持未檢查狀態,直到您在最後一個步驟中重新開啟 Enforce verdicts。
開啟 Inference hooks 設定頁面
仍在 Data and privacy 中,開啟 Inference hooks 區段以進入 Inference hooks 設定頁面。此頁面位於 Data and privacy 底下,而非設定導覽中的獨立項目,因此其導覽路徑顯示為 Data and privacy / Inference hooks。在您儲存端點之前,頁面會警告提示尚未被檢查,且 Enforce verdicts 會保持關閉並顯示 Requires endpoint 標記。
設定您的端點
點擊 Configure 以開啟 Configure endpoint 對話框並填寫:
https:// URL。僅接受 https:// URL。- 而非 _ 分隔,且不得與保留名稱衝突(請求框架標頭如 Content-* 和 Host、代理和 cookie 標頭、用戶端位址標頭如 X-Forwarded-*、webhook-* 簽章標頭,以及 X-Anthropic-* 前綴)。值必須是可列印的 ASCII 字元。此對話框僅涵蓋這兩個欄位以及 Test connection;它不會詢問失敗處理方式,您將在步驟 6 中選擇。一旦儲存端點後,按鈕會顯示為 Edit。
測試連線
點擊 Test connection。Claude 會將一個合成測試提示傳送至表單中目前填寫的 URL 和標頭,而非已儲存的值,因此請在測試前重新輸入任何已儲存的標頭值。成功時,結果會回報您的 AI 安全伺服器對測試提示回傳的是允許還是拒絕裁決,這可在您開始強制執行之前,揭露預設全部拒絕的情況。
常見的失敗結果:
| 結果 | 檢查項目 |
|---|---|
| URL 被拒絕 | URL 未通過結構檢查。請使用連接埠 443 上的 https:// URL。 |
| 私有或內部 IP | 主機解析為私有或內部位址。請使用可公開路由的主機。 |
| 逾時 | AI 安全伺服器未在逾時時間內回傳裁決。 |
| 傳輸錯誤 | DNS 解析、TLS 交握或連線失敗。 |
| 非 200 狀態 | AI 安全伺服器回應的狀態碼不是 200。裁決必須以 HTTP 200 回傳;不會跟隨重新導向,且重新導向會被視為失敗。 |
| 無法解析的回應 | AI 安全伺服器有回應,但回應內容不是有效的裁決。 |
儲存並保存您的簽章密鑰
選擇失敗處理方式和逾時時間
在 Failure handling 下,設定 Mode 以選擇當 AI 安全伺服器無法連線或裁決逾時時的處理方式:
下拉選單的第三個選項 Shadow mode 是推出工具而非失敗政策;請參閱影子模式。
接著設定 Prompt verdict timeout (ms):1 至 10,000 毫秒,預設為 5,000 毫秒。此預算涵蓋整個交換過程,較慢的裁決會被視為伺服器無法連線,因此請設定您的伺服器能可靠達成的最低值。
此區段中的變更會在您進行時自動儲存。首次儲存時,預設值為 Allow the request 和 5,000 毫秒。
選擇推出百分比
在 Rollout 下,設定 Requests inspected (%) 以在您啟用 AI 安全伺服器的過程中,對一定百分比的請求執行檢查。此值範圍為 0 至 100:100 表示檢查所有請求,0 則關閉檢查。
每個請求在其整個對話回合中只會進行一次抽樣判定,因此單一對話可能在不同回合間被部分檢查。未被抽樣到的請求會在未經檢查的情況下繼續進行,即使失敗處理設為 Block the request 也是如此。
開啟 Enforce verdicts
若要在不封鎖任何人的情況下,先針對實際流量評估裁決,請在開啟強制執行之前將 Mode 設為 Shadow mode(步驟 6);請參閱影子模式。
開啟 Enforce verdicts 以讓 Claude 針對每個受管控的提示,依據您的 AI 安全伺服器的裁決進行把關,然後在對話框中確認,該對話框會重述您的失敗處理選擇。請預留約一分鐘讓變更傳達至每個 Anthropic 伺服器;已在處理中的請求會依舊設定完成。關閉此選項會停止將提示傳送至您的 AI 安全伺服器,同樣約需一分鐘生效;您的設定會被保留。
「Shadow mode」(影子模式)會針對實際流量執行您的 hook,但不會封鎖任何內容。您的 AI 安全伺服器會接收受管控的提示並回傳裁決,與強制執行時完全相同,但不會封鎖任何內容:每個請求都會繼續傳送至模型,即使您的伺服器拒絕該請求或無法連線,終端使用者也不會察覺任何異狀。請使用此模式,在開始強制執行之前,針對您組織的實際流量調整您的政策。
若要使用影子模式,請在 Failure handling 下將 Mode 設為 Shadow mode,然後開啟 Enforce verdicts 以讓提示流向您的 AI 安全伺服器。當影子模式啟用時,設定頁面會顯示 Shadow mode — not blocking 標記。若要離開影子模式,請將 Mode 設回 Allow the request 或 Block the request;一旦強制執行開啟,裁決就會再次被強制執行。
在 Exclusions 下,選擇其成員不受 Inference hooks 管控的角色:他們的提示永遠不會傳送至您的 AI 安全伺服器。只有您組織建立的自訂角色可以被排除;內建角色不會出現在選項中。請在角色選擇器中挑選(其預留文字顯示為 Select roles to exclude),並從角色管理頁面(Manage roles)管理每個角色的成員;變更排除項目需要身分管理權限。此清單預設為空,若未排除任何角色,則每個受管控的請求都會被檢查。
排除適用於使用者的互動式工作階段;透過機器憑證驗證的流量一律會被檢查。如果 Claude 無法解析請求者的角色成員資格,該請求會以可重試的錯誤失敗並封鎖,而非在未經檢查的情況下繼續進行。排除清單的變更會記錄在稽核軌跡中。
在 Custom blocked prompt message 下,設定最多 500 個字元的自訂文字,當您的 AI 安全伺服器拒絕請求時,此文字會附加至終端使用者看到的錯誤訊息(通常是聯絡對象或申請例外的位置)。最終訊息會是您的 AI 安全伺服器針對該請求的 deny_reason(若有)、一個空白行,然後是此文字。若未設定自訂文字,內建的預設訊息會引導使用者聯絡其管理員;您也可以完全關閉附加訊息,讓使用者僅看到 deny_reason。
Inference hooks 設定頁面的端點健康狀態區域會顯示:
此面板為盡力而為:如果 Anthropic 無法讀取計數器,它會顯示零失敗且無錯誤,而非顯示自身的錯誤,因此看起來健康的面板本身並不能證明您的 AI 安全伺服器是健康的。Failures per minute 會計算每次失敗,包括永遠不會觸發斷路器的網路和 DNS 錯誤,因此即使 Circuit breaker tripped 保持空白,此數值仍可能很高。
可歸因於您的 AI 安全伺服器的持續 webhook 失敗會觸發「circuit breaker」(斷路器),進而停止強制執行:您的伺服器不再被聯繫,且您的 Failure handling 選擇會套用至每個受檢查的請求。若選擇 Block the request,您組織中的使用者會被封鎖,直到您採取行動。當斷路器觸發時,管理員也會在 claude.ai 通知中心收到通知。
若要恢復,請修復伺服器,然後重新開啟 Enforce verdicts 以重設斷路器。
點擊 Request signing 下的 Rotate secret 以替換您的簽章密鑰。輪替是立即切換:新密鑰會產生並僅顯示一次,舊密鑰無法再取得,且沒有任何請求會同時以兩個密鑰簽署,因此沒有可依賴的重疊期間。
輪替後,以先前密鑰簽署的請求仍可能短暫地送達;驗證簽章說明了您的 AI 安全伺服器應如何處理此切換。
Inference hooks 活動會記錄在您組織的 Activity Feed 中:設定變更、拒絕裁決,以及在您的失敗處理設定下未經檢查而繼續進行的請求。拒絕記錄帶有識別碼,讓您可以將每個拒絕與您自己系統中的對應記錄進行比對。
有兩個層級的關閉:
建置 AI 安全伺服器:請求和裁決結構描述、簽章驗證,以及操作語意。
Inference hooks 是什麼、裁決往返如何運作,以及會傳送哪些內容至您的 AI 安全伺服器。
Was this page helpful?