Inference hooks를 사용하면 Claude Enterprise 조직이 추론이 실행되기 전에 모든 관리 대상 프롬프트를 AI 보안 서버(조직 또는 해당 보안 벤더가 운영하는 HTTPS 서비스)를 통해 라우팅할 수 있습니다. 사용자가 프롬프트를 제출하면 Anthropic은 대화 기록을 AI 보안 서버로 전송하고 허용 또는 거부 판정을 기다립니다. 거부된 요청은 모델에 도달하지 않습니다. 보안 및 규정 준수 팀은 Inference hooks를 사용하여 데이터 정책을 인라인으로 적용하고, 개발자는 각 요청을 평가하는 AI 보안 서버를 구축합니다.
이 hook은 요청이 클라이언트를 떠난 후 모델이 실행되기 전에 Anthropic의 서버에서 실행되므로, 사용자 기기에 아무것도 설치하거나 배포할 필요 없이 모든 관리 대상 요청에 균일하게 적용됩니다.
현재 유일한 hook 이벤트는 prompt이며, 추론이 시작되기 전에 관리 대상 추론 요청당 한 번 실행됩니다. 응답 측 적용은 향후 이벤트로 계획되어 있습니다.
POST를 전송합니다. 요청 본문에는 대화 기록이 포함되며, 조직이 서명 시크릿을 생성한 후에는 각 요청이 Standard Webhooks 사양에 따라 서명되므로 서버에서 해당 요청이 Anthropic에서 온 것인지 확인할 수 있습니다.allow인 경우 추론이 정상적으로 진행됩니다. deny인 경우 요청이 거부되고 사용자에게 정책에 의해 차단되었다는 메시지가 표시됩니다. 이 메시지는 두 부분으로 구성됩니다. AI 보안 서버가 판정의 deny_reason 필드에 제공한 요청별 사유가 먼저 표시되고, 그 뒤에 관리자가 구성한 고정 메시지(예: 연락 대상 또는 예외 요청 방법)가 이어집니다. 관리자가 이를 구성하지 않은 경우 기본 제공 메시지가 사용자에게 관리자에게 문의하도록 안내합니다. 각 거부는 조직의 Activity Feed에도 기록됩니다.다음 다이어그램은 흐름의 어느 부분이 hook되는지 보여주기 위해 한 가지 예시(Claude가 O365 도구도 호출하는 Cowork 요청)를 추적합니다. Hook되는 지점은 다이어그램의 1단계와 5단계로, 프롬프트가 도착하고 도구 결과가 반환되는 지점입니다. 각 지점은 2단계와 6단계에 표시된 AI 보안 서버와의 검증 교환으로 이어집니다.
판정은 작은 JSON 객체입니다. {"action": "allow"}는 요청을 진행시키고, 거부는 사용자에게 표시될 사유를 포함합니다. 전체 판정 스키마는 판정 반환을 참조하세요.
AI 보안 서버는 사용자가 보는 것과 동일한 내용을 봅니다. 즉, 대화 기록 텍스트, 도구 호출 및 그 결과, 첨부 파일에서 추출된 텍스트입니다. 원본 파일 또는 이미지 바이트, 시스템 프롬프트, Anthropic 내부 컨텍스트는 절대 수신하지 않습니다.
AI 보안 서버에 연결할 수 없거나, 오류를 반환하거나, 타임아웃 내에 응답하지 않는 경우 조직의 실패 처리 설정에 따라 결과가 결정됩니다. 즉, 요청을 차단하거나 검사 없이 진행하도록 허용합니다.
적용은 원하는 속도로 롤아웃할 수 있으므로 첫날부터 누군가를 차단할 필요가 없습니다. 섀도우 모드는 아무것도 차단하지 않고 실제 트래픽에서 판정을 관찰하고, 롤아웃 비율은 선택한 비율의 요청만 검사하며, 제외 설정은 선택한 역할의 구성원을 완전히 면제합니다. Inference hooks 구성을 참조하세요.
전체 요청 및 응답 스키마, 서명 검증, 운영 세부 정보는 통합 개발을 참조하세요.
allow를 반환합니다. Compliance API를 폴링하는 방식의 푸시 기반 대안입니다.Inference hooks는 Claude Enterprise 조직에서 사용할 수 있습니다. 이를 구성하려면 organization:manage 권한이 필요하며, 기본 제공 Admin, Owner, Primary owner 역할과 해당 권한이 부여된 모든 사용자 지정 역할이 이를 보유합니다.
하나의 hook이 Claude Enterprise 조직의 claude.ai, Cowork, Claude Code 세션 전반의 대화를 관리하며, 웹, 데스크톱 앱, CLI 어디에서 실행되든 적용됩니다. Inference hooks는 Amazon Bedrock 또는 Google Cloud에서는 사용할 수 없습니다.
관리 대상 요청은 사용자 대화의 기반이 되는 추론 요청입니다. 대화 제목 생성과 같은 부수적 요청은 엔드포인트로 전송되지 않으며, 시스템 프롬프트와 도구 정의는 전송되는 내용에 절대 포함되지 않습니다. 음성 모드는 적용 대상이 아닙니다.
두 기능 모두 Claude Enterprise 조직의 보안, 법무, 규정 준수 팀을 위한 것입니다.
| Inference hooks | Compliance API | |
|---|---|---|
| 작동 시점 | 인라인, 추론 실행 전 | 사후 |
| 수행 작업 | 각 관리 대상 요청을 실시간으로 허용 또는 거부 | 감사 및 내보내기를 위해 활동, 채팅, 파일, 프로젝트, Cowork 및 Claude Code 세션 기록, 사용자를 조회 |
| 방향 | Anthropic이 AI 보안 서버를 호출 | 사용자가 Anthropic의 API를 호출 |
요청이 모델에 도달하기 전에 중단하려면 Inference hooks를 사용하고, 이후에 발생한 일을 감사하려면 Compliance API를 사용하세요.
조직에 Inference hooks를 허용하고, AI 보안 서버를 설정 및 테스트하고, 실패 처리를 선택하고, 판정을 적용합니다.
AI 보안 서버 구축을 위한 요청 및 판정 스키마, 서명 검증, 운영 시맨틱, 통합 패턴입니다.
Was this page helpful?