"Inference hooks"(推理钩子)会将您组织的提示发送到您选择的 AI 安全服务器,并在 Claude 处理每个请求之前等待允许或拒绝的裁定结果。本页将引导您完成启用该功能、连接服务器以及控制执行策略的过程。如需了解 Inference hooks 是什么以及何时使用,请参阅 Inference hooks 概述。如需构建 AI 安全服务器本身,请参阅开发 Inference hooks 集成。
您需要:
organization:manage 权限。内置的 Admin、Owner 和 Primary owner 角色拥有此权限,任何被授予该权限的自定义角色也同样拥有。https:// URL,位于可公开路由的主机上,且无需重定向即可访问。有关完整的托管要求,以及如何构建服务器和验证签名请求,请参阅开发 Inference hooks 集成。共有三种执行状态:关闭(Enforce verdicts 处于关闭状态:永远不会联系您的 AI 安全服务器,也不会检查提示)、影子模式(Enforce verdicts 处于开启状态且 Mode 设置为 Shadow mode:您的 AI 安全服务器会接收提示并返回裁定结果,但不会阻止任何内容)以及执行中(Enforce verdicts 处于开启状态且 Mode 设置为 Allow the request 或 Block the request:拒绝裁定会阻止请求)。以下步骤将引导您将新配置从关闭状态切换到执行状态。
为您的组织启用 Inference hooks
前往 claude.ai > Organization settings > Data and privacy,找到 Inference hooks 部分。开启 Allow for your organization。
开启此选项会解锁 Inference hooks 设置页面,并始终强制将 Enforce verdicts 设为关闭,因此启用该功能本身绝不会启动检查:即使之前已开启执行的配置,在您于最后一步重新开启 Enforce verdicts 之前,也会保持不受检查的状态。
打开 Inference hooks 设置页面
仍在 Data and privacy 中,打开 Inference hooks 部分以进入 Inference hooks 设置页面。该页面位于 Data and privacy 下,而非设置导航中的独立条目,因此其面包屑导航显示为 Data and privacy / Inference hooks。在您保存端点之前,页面会警告提示尚未被检查,且 Enforce verdicts 保持关闭状态并显示 Requires endpoint 徽章。
配置您的端点
点击 Configure 打开 Configure endpoint 对话框并填写:
https:// URL。仅接受 https:// URL。- 而非 _,且不得与保留名称冲突(请求框架类请求头如 Content-* 和 Host、代理和 Cookie 请求头、客户端地址请求头如 X-Forwarded-*、webhook-* 签名请求头以及 X-Anthropic-* 前缀)。值必须是可打印的 ASCII 字符。该对话框仅包含这两个字段以及 Test connection;它不会询问故障处理方式,您将在第 6 步中进行选择。保存端点后,按钮将显示为 Edit。
测试连接
点击 Test connection。Claude 会向表单中当前填写的 URL 和请求头(而非已保存的值)发送一个合成测试提示,因此在测试前请重新输入所有已存储的请求头值。成功时,结果会报告您的 AI 安全服务器对测试提示返回的是允许还是拒绝裁定,这有助于在您开始执行之前发现"默认拒绝一切"的配置问题。
常见的失败结果:
| 结果 | 检查内容 |
|---|---|
| URL 被拒绝 | URL 未通过结构检查。请使用 443 端口上的 https:// URL。 |
| 私有或内部 IP | 主机解析为私有或内部地址。请使用可公开路由的主机。 |
| 超时 | AI 安全服务器未在超时时间内返回裁定结果。 |
| 传输错误 | DNS 解析、TLS 握手或连接失败。 |
| 非 200 状态 | AI 安全服务器返回了 200 以外的状态码。裁定结果必须以 HTTP 200 返回;不会跟随重定向,重定向将被视为失败。 |
| 无法解析的响应 | AI 安全服务器已响应,但响应体不是有效的裁定结果。 |
保存并存储您的签名密钥
选择故障处理方式和超时时间
在 Failure handling 下,设置 Mode 以选择当 AI 安全服务器无法访问或裁定超时时的处理方式:
下拉菜单的第三个选项 Shadow mode 是一个灰度发布工具,而非故障策略;请参阅影子模式。
然后设置 Prompt verdict timeout (ms):1 到 10,000 毫秒,默认为 5,000 毫秒。该时间预算涵盖整个交互过程,较慢的裁定会被视为服务器无法访问,因此请设置您的服务器能够可靠满足的最低值。
此部分的更改会在您修改时自动保存。首次保存时,默认值为 Allow the request 和 5,000 毫秒。
选择灰度发布百分比
在 Rollout 下,设置 Requests inspected (%),以便在您逐步上线 AI 安全服务器时对一定百分比的请求运行检查。该值范围为 0 到 100:100 表示检查所有请求,0 表示关闭检查。
每个请求在其整个对话轮次中只进行一次抽样判定,因此单个对话在不同轮次中可能被部分检查。未被抽中的请求将在不经检查的情况下继续处理,即使故障处理设置为 Block the request 也是如此。
开启 Enforce verdicts
如需在不阻止任何人的情况下先针对实时流量评估裁定结果,请在开启执行之前将 Mode 设置为 Shadow mode(第 6 步);请参阅影子模式。
开启 Enforce verdicts,使 Claude 对每个受管控的提示都依据您的 AI 安全服务器的裁定结果进行把关,然后在对话框中确认,该对话框会重述您的故障处理选择。请预留约一分钟时间,以便更改传播到每台 Anthropic 服务器;已在处理中的请求将按旧设置完成。关闭此选项会停止向您的 AI 安全服务器发送提示,同样需要约一分钟生效;您的配置会被保留。
"Shadow mode"(影子模式)会针对实时流量运行您的钩子,但不会阻止任何内容。您的 AI 安全服务器会像执行时一样接收受管控的提示并返回裁定结果,但不会阻止任何内容:每个请求都会继续发送到模型,即使您的服务器拒绝了该请求或无法访问,最终用户也不会察觉任何异常。使用此模式可在开始执行之前,根据您组织的真实流量调整策略。
要使用影子模式,请在 Failure handling 下将 Mode 设置为 Shadow mode,然后开启 Enforce verdicts,以便提示流向您的 AI 安全服务器。当影子模式处于活动状态时,设置页面会显示 Shadow mode — not blocking 徽章。要退出影子模式,请将 Mode 改回 Allow the request 或 Block the request;一旦执行开启,裁定结果将再次被强制执行。
在 Exclusions 下,选择其成员不受 Inference hooks 管控的角色:这些成员的提示永远不会被发送到您的 AI 安全服务器。只能排除您的组织创建的自定义角色;内置角色不在可选范围内。在角色选择器中选择它们(其占位符文本为 Select roles to exclude),并从角色管理页面(Manage roles)管理每个角色的成员;更改排除项需要身份管理权限。该列表默认为空,在未排除任何角色的情况下,每个受管控的请求都会被检查。
排除适用于用户的交互式会话;通过机器凭据进行身份验证的流量始终会被检查。如果 Claude 无法解析请求者的角色成员身份,该请求将以可重试的错误方式故障关闭,而不是在未经检查的情况下继续处理。对排除列表的更改会记录在审计跟踪中。
在 Custom blocked prompt message 下,设置最多 500 个字符的自定义文本,该文本会附加到当您的 AI 安全服务器拒绝请求时最终用户看到的错误信息中(通常是联系人信息或申请例外的途径)。最终消息的组成为:您的 AI 安全服务器针对该请求返回的 deny_reason(如果存在)、一个空行,然后是此文本。如果未配置自定义文本,内置的默认消息会引导用户联系其管理员;您也可以完全关闭附加消息,使用户仅看到 deny_reason。
Inference hooks 设置页面的端点健康状况区域显示:
该面板采用尽力而为的方式:如果 Anthropic 无法读取计数器,它会显示零失败且无错误,而不是显示自身的错误,因此面板看起来健康本身并不能证明您的 AI 安全服务器是健康的。Failures per minute 统计所有失败,包括那些永远不会触发熔断器的网络和 DNS 错误,因此该值可能很高,而 Circuit breaker tripped 仍为空。
可归因于您的 AI 安全服务器的持续 webhook 失败会触发"circuit breaker"(熔断器),从而停止执行:不再联系您的服务器,并且您的 Failure handling 选择将应用于每个被检查的请求。如果选择了 Block the request,您组织中的用户将被阻止,直到您采取行动。当熔断器触发时,管理员也会在 claude.ai 通知中心收到通知。
要恢复,请修复服务器,然后重新开启 Enforce verdicts 以重置熔断器。
点击 Request signing 下的 Rotate secret 以替换您的签名密钥。轮换是即时切换:新密钥会生成并仅显示一次,旧密钥无法再被获取,且不会有任何请求同时使用两个密钥签名,因此不存在可依赖的重叠期。
轮换后,使用先前密钥签名的请求可能仍会短暂到达;验证签名介绍了您的 AI 安全服务器应如何处理这一切换过程。
Inference hooks 活动会记录在您组织的 Activity Feed 中:配置更改、拒绝记录,以及在您的故障处理设置下未经检查而继续处理的请求。拒绝记录带有标识符,可让您将每次拒绝与您自己系统中的匹配记录进行关联。
有两个级别的关闭:
构建 AI 安全服务器:请求和裁定结果的架构、签名验证以及操作语义。
了解 Inference hooks 是什么、裁定往返流程如何运作,以及哪些内容会被发送到您的 AI 安全服务器。
Was this page helpful?