Claude Platform Docs
관리자추론 훅

Inference hooks

추론이 진행되기 전에 관리 대상 프롬프트 각각을 조직의 AI 보안 서버로 전송하여 허용 또는 거부 판정을 받습니다.

"Inference hooks"(추론 훅)를 사용하면 Claude Enterprise 조직이 추론이 실행되기 전에 모든 관리 대상 프롬프트를 AI 보안 서버, 즉 조직 또는 조직의 보안 벤더가 운영하는 HTTPS 서비스를 통해 라우팅할 수 있습니다. 사용자가 프롬프트를 제출하면 Anthropic은 대화 트랜스크립트를 조직의 AI 보안 서버로 전송하고 허용 또는 거부 판정을 기다립니다. 거부된 요청은 모델에 도달하지 않습니다. 보안 및 컴플라이언스 팀은 Inference hooks를 사용하여 데이터 정책을 인라인으로 적용하고, 개발자는 각 요청을 평가하는 AI 보안 서버를 구축합니다.

훅은 요청이 클라이언트를 떠난 후 모델이 실행되기 전에 Anthropic의 서버에서 실행되므로, 사용자 기기에 설치하거나 배포할 것 없이 모든 관리 대상 요청에 균일하게 적용됩니다.

현재 유일한 훅 이벤트는 prompt이며, 관리 대상 추론 요청마다 추론이 시작되기 전에 한 번 발생합니다. 응답 측 적용은 이후 이벤트로 계획되어 있습니다.


Inference hooks 작동 방식

  1. 사용자가 관리 대상 표면에서 프롬프트를 제출합니다.
  2. Anthropic이 조직에 구성된 AI 보안 서버 엔드포인트로 HTTPS POST를 전송합니다. 요청 본문에는 대화 트랜스크립트가 담기며, 조직이 서명 시크릿을 생성하면 각 요청은 Standard Webhooks 사양에 따라 서명되므로 서버에서 해당 요청이 Anthropic에서 온 것인지 검증할 수 있습니다.
  3. AI 보안 서버가 콘텐츠를 평가하고 조직이 구성한 판정 타임아웃(기본값 5초) 내에 판정으로 응답합니다.
  4. allow인 경우 추론이 정상적으로 진행됩니다. deny인 경우 요청이 거부되고 사용자에게는 두 부분으로 구성된 정책 차단 메시지가 표시됩니다. 먼저 AI 보안 서버가 판정의 deny_reason 필드에 제공한 요청별 사유가 표시되고, 이어서 관리자가 구성한 고정 메시지(예: 문의할 담당자 또는 예외를 요청할 곳)가 표시됩니다. 관리자가 이를 구성하지 않은 경우 기본 제공 메시지가 사용자에게 관리자에게 문의하도록 안내합니다. 각 거부는 조직의 Activity Feed에도 기록됩니다.

다음 다이어그램은 하나의 예시(Claude가 O365 도구도 호출하는 Cowork 요청)를 따라가며 흐름의 어느 부분에 훅이 적용되는지 보여줍니다. 훅이 적용되는 지점은 프롬프트가 도착하고 도구 결과가 반환되는 다이어그램의 1단계와 5단계이며, 각각 2단계와 6단계에 표시된 AI 보안 서버와의 검증 교환으로 이어집니다.

흐름 다이어그램: 추론이 진행되기 전에 AI security server(AI 보안 서버)가 prompt(프롬프트)와 tool result(도구 결과)를 모두 검증합니다

판정은 작은 JSON 객체입니다. {"action": "allow"}는 요청을 진행시키고, 거부는 사용자에게 표시되는 사유를 담습니다. 전체 판정 스키마는 판정 반환을 참조하세요.

AI 보안 서버는 사용자가 보는 것을 봅니다. 즉 트랜스크립트 텍스트, 도구 호출 및 그 결과, 첨부 파일에서 추출된 텍스트입니다. 원시 파일 또는 이미지 바이트, 시스템 프롬프트, Anthropic 내부 컨텍스트는 절대 수신하지 않습니다. Anthropic은 Inference hooks의 일부로 프롬프트 또는 응답 콘텐츠를 저장하지 않으며, 판정, 타임스탬프, 요청 식별자와 같은 훅 활동에 대한 메타데이터만 기록합니다.

AI 보안 서버에 연결할 수 없거나, 오류를 반환하거나, 타임아웃 내에 응답하지 않는 경우 조직의 실패 처리 설정이 결과를 결정합니다. 요청을 차단하거나, 검사 없이 진행하도록 허용합니다.

적용은 조직의 속도에 맞춰 롤아웃할 수 있으므로 첫날부터 누군가가 차단될 필요가 없습니다. 섀도 모드는 아무것도 차단하지 않고 실제 트래픽에 대한 판정을 관찰하고, 롤아웃 비율은 선택한 비율의 요청만 검사하며, 제외 설정은 선택한 역할의 구성원을 완전히 면제합니다. Inference hooks 구성을 참조하세요.

전체 요청 및 응답 스키마, 서명 검증, 운영 세부 사항은 통합 개발을 참조하세요.


사용 사례

  • "Data loss prevention"(데이터 손실 방지), 즉 DLP. 트랜스크립트를 DLP 스캐너로 전달하고 규제 대상 또는 기밀 자료가 포함된 프롬프트를 거부합니다. 가장 일반적인 배포 형태입니다.
  • 실시간 트랜스크립트 보관. 각 트랜스크립트가 도착하는 대로 보관하고 항상 allow를 반환합니다. Compliance API를 폴링하는 방식에 대한 푸시 기반 대안입니다.
  • 프롬프트 텔레메트리. 조직이 Claude를 어떻게 사용하는지 사용 시점에 측정합니다.
  • 정책 엔진. 추론 전에 자체 규칙을 적용합니다. 모델 허용 목록, 프로젝트 범위 제한, 근무 시간 제어 등이 있습니다.

현재 제한 사항

  • 첨부 파일은 메타데이터와 추출된 텍스트로 표현됩니다. 원시 파일 및 이미지 바이트는 절대 전송되지 않으므로 이미지 전용 콘텐츠(예: 문서 스크린샷)는 검사되지 않습니다.
  • 판정은 허용 또는 거부입니다. 프롬프트 재작성 또는 수정(redacting)은 지원되지 않습니다.
  • 플랫폼 조직(Claude Platform을 통한 API 액세스)은 범위에 포함되지 않습니다.

가용성

Inference hooks는 Claude Enterprise 조직에서 사용할 수 있습니다. 이를 구성하려면 organization:manage 권한이 필요하며, 이 권한은 기본 제공되는 Admin, Owner, Primary owner 역할과 해당 권한이 부여된 모든 사용자 지정 역할이 보유합니다.

하나의 훅이 Claude Enterprise 조직 내 claude.ai, Cowork, Claude Code 세션 전반의 대화를 관리하며, 웹, 데스크톱 앱, CLI 중 어디에서 실행되든 마찬가지입니다. Inference hooks는 Amazon Bedrock 또는 Google Cloud에서는 사용할 수 없습니다.

관리 대상 요청은 사용자 대화 뒤에서 이루어지는 추론 요청입니다. 대화 제목 생성과 같은 부수적 요청은 엔드포인트로 전송되지 않으며, 시스템 프롬프트와 도구 정의는 전송되는 내용에 절대 포함되지 않습니다. 음성 모드는 적용 대상이 아닙니다.


Inference hooks와 Compliance API 비교

두 기능 모두 Claude Enterprise 조직의 보안, 법무, 컴플라이언스 팀을 위한 것입니다.

Inference hooksCompliance API
작동 시점인라인, 추론 실행 전사후
수행 작업각 관리 대상 요청을 실시간으로 허용 또는 거부감사 및 내보내기를 위해 활동, 채팅, 파일, 프로젝트, 세션 트랜스크립트, 사용자를 조회
방향Anthropic이 조직의 AI 보안 서버를 호출조직이 Anthropic의 API를 호출

요청이 모델에 도달하기 전에 중단하려면 Inference hooks를 사용하고, 이후에 무슨 일이 있었는지 감사하려면 Compliance API를 사용하세요.


이 섹션의 내용

조직에 Inference hooks를 허용하고, AI 보안 서버를 설정 및 테스트하고, 실패 처리를 선택하고, 판정을 적용합니다.

AI 보안 서버 구축을 위한 요청 및 판정 스키마, 서명 검증, 운영 의미론, 통합 패턴입니다.

Was this page helpful?