推理钩子允许 Claude Enterprise 组织在推理运行之前,将每个受管控的提示路由到一个 AI 安全服务器——即由该组织或其安全供应商运营的 HTTPS 服务。当用户提交提示时,Anthropic 会将对话记录发送到您的 AI 安全服务器,并等待允许或拒绝的裁定;被拒绝的请求永远不会到达模型。安全与合规团队使用推理钩子来内联执行数据策略,而开发人员则负责构建用于评估每个请求的 AI 安全服务器。
由于钩子在 Anthropic 的服务器上运行——在请求离开客户端之后、模型运行之前——因此它会统一应用于每个受管控的请求,无需在用户设备上安装或部署任何内容。
目前唯一的钩子事件是 prompt,它在每个受管控的推理请求开始推理之前触发一次。响应侧的执行计划作为后续事件推出。
POST 请求。请求正文包含对话记录,并且在您的组织生成签名密钥后,每个请求都会根据 Standard Webhooks 规范进行签名,以便您的服务器可以验证请求来自 Anthropic。allow,推理正常进行。如果裁定为 deny,请求将被拒绝,用户会看到一条由两部分组成的"被策略阻止"消息:首先是您的 AI 安全服务器在裁定的 deny_reason 字段中提供的针对该请求的原因,然后是您的管理员配置的常设消息(例如,联系谁或在哪里申请例外)。如果您的管理员尚未配置此消息,则会显示内置的默认消息,指引用户联系管理员。每次拒绝也会记录在您组织的活动动态中。下图追踪了一个示例(一个 Cowork 请求,其中 Claude 还调用了 O365 工具),以说明流程中哪些部分被钩子拦截。被钩子拦截的点是图中的步骤 1 和步骤 5,即提示到达和工具结果返回的位置;每个点都会触发步骤 2 和步骤 6 中所示的与您的 AI 安全服务器之间的验证交换。
裁定是一个小型 JSON 对象:{"action": "allow"} 允许请求继续,而拒绝裁定则包含面向用户的原因。有关完整的裁定架构,请参阅返回裁定。
您的 AI 安全服务器看到的内容与用户看到的内容一致:对话记录文本、工具调用及其结果,以及从附件中提取的文本。它永远不会收到原始文件或图像字节、系统提示或 Anthropic 内部上下文。
如果您的 AI 安全服务器无法访问、返回错误或未在超时时间内响应,则由您组织的故障处理设置决定结果:阻止请求,或允许请求在未经检查的情况下继续。
执行可以按您的节奏逐步推出,因此无需在第一天就阻止任何人:"shadow mode"(影子模式)在实时流量上观察裁定而不阻止任何内容,"rollout percentage"(推出百分比)检查选定比例的请求,而"exclusions"(排除项)则完全豁免选定角色的成员。请参阅配置推理钩子。
有关完整的请求和响应架构、签名验证以及操作详情,请参阅开发集成。
allow,作为轮询 Compliance API 的基于推送的替代方案。推理钩子面向 Claude Enterprise 组织提供。配置推理钩子需要 organization:manage 权限,内置的 Admin、Owner 和 Primary owner 角色以及任何被授予此权限的自定义角色均具备该权限。
一个钩子即可管控您 Claude Enterprise 组织中跨 claude.ai、Cowork 和 Claude Code 会话的对话,无论这些会话是在网页端、桌面应用还是 CLI 中运行。推理钩子在 Amazon Bedrock 或 Google Cloud 上不可用。
受管控的请求是指用户对话背后的推理请求。辅助请求(例如对话标题生成)不会发送到您的端点,系统提示和工具定义也永远不会包含在发送的内容中。语音模式不在覆盖范围内。
这两项功能均服务于 Claude Enterprise 组织的安全、法务和合规团队。
| 推理钩子 | Compliance API | |
|---|---|---|
| 作用时机 | 内联,在推理运行之前 | 事后 |
| 功能 | 实时允许或拒绝每个受管控的请求 | 检索活动、聊天、文件、项目、Cowork 和 Claude Code 会话记录以及用户,用于审计和导出 |
| 方向 | Anthropic 调用您的 AI 安全服务器 | 您调用 Anthropic 的 API |
使用推理钩子在请求到达模型之前将其拦截,使用 Compliance API 审计事后发生的情况。
Was this page helpful?