Inference hooks는 조직의 프롬프트를 선택한 AI 보안 서버로 전송하고, Claude가 처리하기 전에 각 요청에 대한 허용 또는 거부 판정을 기다립니다. 이 페이지에서는 기능 활성화, 서버 연결, 적용 제어 방법을 안내합니다. Inference hooks가 무엇이며 언제 사용해야 하는지는 Inference hooks 개요를 참조하세요. AI 보안 서버 자체를 구축하려면 Inference hooks 통합 개발을 참조하세요.
다음이 필요합니다:
organization:manage 권한. 기본 제공 Admin, Owner, Primary owner 역할과 해당 권한이 부여된 모든 사용자 지정 역할이 이 권한을 보유합니다.https:// URL이며, 공개적으로 라우팅 가능한 호스트에 있고, 리디렉션 없이 도달할 수 있어야 합니다. 전체 호스팅 요구 사항과 서버 구축 및 서명된 요청 검증 방법은 Inference hooks 통합 개발을 참조하세요.세 가지 적용 상태가 있습니다: 꺼짐(Enforce verdicts가 꺼져 있음: AI 보안 서버에 연결되지 않으며 프롬프트가 검사되지 않음), 섀도우(Enforce verdicts가 켜져 있고 Mode가 Shadow mode로 설정됨: AI 보안 서버가 프롬프트를 수신하고 판정을 반환하지만 아무것도 차단되지 않음), 적용 중(Enforce verdicts가 켜져 있고 Mode가 Allow the request 또는 Block the request로 설정됨: 거부 시 요청이 차단됨). 다음 단계는 새 구성을 꺼짐 상태에서 적용 중 상태로 전환합니다.
조직에 Inference hooks 허용
claude.ai > Organization settings > Data and privacy로 이동하여 Inference hooks 섹션을 찾으세요. Allow for your organization을 켜세요.
이를 켜면 Inference hooks 설정 페이지가 잠금 해제되고 Enforce verdicts가 항상 강제로 꺼지므로, 기능을 허용하는 것만으로는 검사가 시작되지 않습니다. 이전에 적용이 켜져 있던 구성이라도 마지막 단계에서 Enforce verdicts를 다시 켤 때까지 검사되지 않은 상태로 유지됩니다.
Inference hooks 설정 페이지 열기
Data and privacy에서 Inference hooks 섹션을 열어 Inference hooks 설정 페이지로 이동하세요. 이 페이지는 설정 탐색 메뉴의 독립 항목이 아니라 Data and privacy 아래에 있으므로, 경로 표시가 Data and privacy / Inference hooks로 나타납니다. 엔드포인트를 저장하기 전까지 페이지에는 프롬프트가 아직 검사되지 않고 있다는 경고가 표시되며, Enforce verdicts는 Requires endpoint 배지와 함께 꺼진 상태로 유지됩니다.
엔드포인트 구성
Configure를 클릭하여 Configure endpoint 대화 상자를 열고 다음을 입력하세요:
https:// URL입니다. https:// URL만 허용됩니다._ 대신 -를 사용하는 표준 HTTP 토큰 문자를 사용해야 하며, 예약된 이름(요청 프레이밍 헤더인 Content-* 및 Host, 프록시 및 쿠키 헤더, X-Forwarded-*와 같은 클라이언트 주소 헤더, webhook-* 서명 헤더, X-Anthropic-* 접두사)과 충돌해서는 안 됩니다. 값은 출력 가능한 ASCII여야 합니다.대화 상자는 이 두 필드와 Test connection만 다루며, 실패 처리는 6단계에서 선택하므로 여기서는 묻지 않습니다. 엔드포인트가 저장되면 버튼이 Edit로 표시됩니다.
연결 테스트
Test connection을 클릭하세요. Claude는 저장된 값이 아니라 현재 양식에 있는 URL과 헤더로 합성 테스트 프롬프트를 전송하므로, 테스트하기 전에 저장된 헤더 값을 다시 입력하세요. 성공 시 결과는 AI 보안 서버가 테스트 프롬프트에 대해 허용 또는 거부 판정을 반환했는지 보고하므로, 적용을 시작하기 전에 모든 것을 거부하는 기본값을 미리 확인할 수 있습니다.
일반적인 실패 결과:
| 결과 | 확인할 사항 |
|---|---|
| URL rejected | URL이 구조 검사에 실패했습니다. 포트 443의 https:// URL을 사용하세요. |
| Private or internal IP | 호스트가 사설 또는 내부 주소로 확인됩니다. 공개적으로 라우팅 가능한 호스트를 사용하세요. |
| Timeout | AI 보안 서버가 제한 시간 내에 판정을 반환하지 않았습니다. |
| Transport error | DNS 확인, TLS 핸드셰이크 또는 연결이 실패했습니다. |
| Non-200 status | AI 보안 서버가 200이 아닌 상태로 응답했습니다. 판정은 HTTP 200으로 반환되어야 하며, 리디렉션은 따르지 않고 실패로 간주됩니다. |
| Unparseable response | AI 보안 서버가 응답했지만 본문이 유효한 판정이 아닙니다. |
저장 및 서명 시크릿 보관
실패 처리 및 제한 시간 선택
Failure handling에서 Mode를 설정하여 AI 보안 서버에 도달할 수 없거나 판정이 시간 초과될 때 어떻게 처리할지 선택하세요:
드롭다운의 세 번째 옵션인 Shadow mode는 실패 정책이 아니라 롤아웃 도구입니다. 섀도우 모드를 참조하세요.
그런 다음 **Prompt verdict timeout (ms)**을 설정하세요: 1~10,000ms이며 기본값은 5,000ms입니다. 이 예산은 전체 교환을 포함하며, 더 느린 판정은 도달할 수 없는 서버로 간주되므로 서버가 안정적으로 충족할 수 있는 가장 낮은 값을 설정하세요.
이 섹션의 변경 사항은 변경하는 즉시 저장됩니다. 첫 저장 시 기본값은 Allow the request와 5,000ms입니다.
롤아웃 비율 선택
Rollout에서 **Requests inspected (%)**를 설정하여 AI 보안 서버를 가동하는 동안 일정 비율의 요청에 대해 검사를 실행하세요. 값의 범위는 0~100입니다. 100은 모든 것을 검사하고 0은 검사를 끕니다.
각 요청은 전체 대화 턴에 대해 한 번 주사위를 굴리므로, 단일 대화가 턴마다 부분적으로 검사될 수 있습니다. 샘플링된 비율 밖의 요청은 실패 처리가 Block the request로 설정되어 있어도 검사 없이 진행됩니다.
Enforce verdicts 켜기
처음에 아무도 차단하지 않고 실제 트래픽에 대해 판정을 평가하려면, 적용을 켜기 전에 Mode를 Shadow mode(6단계)로 설정하세요. 섀도우 모드를 참조하세요.
Enforce verdicts를 켜서 모든 관리 대상 프롬프트에 대해 AI 보안 서버의 판정에 따라 Claude를 제어하도록 한 다음, 실패 처리 선택을 다시 표시하는 대화 상자에서 확인하세요. 변경 사항이 모든 Anthropic 서버에 도달하는 데 약 1분이 소요되며, 이미 진행 중인 요청은 이전 설정으로 완료됩니다. 이를 끄면 약 1분 이내에 프롬프트가 AI 보안 서버로 전송되지 않으며, 구성은 유지됩니다.
섀도우 모드는 아무것도 차단하지 않고 실제 트래픽에 대해 훅을 실행합니다. AI 보안 서버는 적용 시와 동일하게 관리 대상 프롬프트를 수신하고 판정을 반환하지만, 아무것도 차단되지 않습니다. 서버가 거부하거나 도달할 수 없는 경우에도 모든 요청이 모델로 진행되며, 최종 사용자에게는 아무것도 표시되지 않습니다. 적용을 시작하기 전에 조직의 실제 트래픽에 대해 정책을 조정하는 데 사용하세요.
섀도우 모드를 사용하려면 Failure handling에서 Mode를 Shadow mode로 설정한 다음, 프롬프트가 AI 보안 서버로 흐르도록 Enforce verdicts를 켜세요. 활성화된 동안 설정 페이지에 Shadow mode — not blocking 배지가 표시됩니다. 섀도우 모드를 종료하려면 Mode를 다시 Allow the request 또는 Block the request로 설정하세요. 적용이 켜져 있으면 판정이 다시 적용됩니다.
Exclusions에서 Inference hooks의 적용을 받지 않는 역할을 선택하세요. 해당 구성원의 프롬프트는 AI 보안 서버로 전송되지 않습니다. 조직에서 생성한 사용자 지정 역할만 제외할 수 있으며, 기본 제공 역할은 제공되지 않습니다. 플레이스홀더가 Select roles to exclude로 표시되는 역할 선택기에서 선택하고, 각 역할을 보유한 사용자는 역할 관리 페이지(Manage roles)에서 관리하세요. 제외를 변경하려면 ID 관리 권한이 필요합니다. 목록은 기본적으로 비어 있으며, 제외된 역할이 없으면 모든 관리 대상 요청이 검사됩니다.
제외는 사용자의 대화형 세션에 적용되며, 머신 자격 증명으로 인증된 트래픽은 항상 검사됩니다. Claude가 요청자의 역할 멤버십을 확인할 수 없는 경우, 요청은 검사 없이 진행되는 대신 재시도 가능한 오류와 함께 fail closed 처리됩니다. 제외 목록의 변경 사항은 감사 추적에 기록됩니다.
Custom blocked prompt message에서 AI 보안 서버가 요청을 거부할 때 최종 사용자에게 표시되는 오류에 추가되는 최대 500자의 사용자 지정 텍스트를 설정하세요(일반적으로 연락할 담당자 또는 예외를 요청할 위치). 최종 메시지는 AI 보안 서버의 요청별 deny_reason(있는 경우), 빈 줄, 그다음 이 텍스트 순서입니다. 사용자 지정 텍스트가 구성되지 않은 경우 기본 제공 기본값이 사용자에게 관리자에게 문의하도록 안내합니다. 추가되는 메시지를 완전히 끄면 사용자에게 deny_reason만 표시되도록 할 수도 있습니다.
Inference hooks 설정 페이지의 엔드포인트 상태 영역에는 다음이 표시됩니다:
이 패널은 최선의 노력 기반입니다. Anthropic이 카운터를 읽을 수 없는 경우 자체 오류 대신 실패 0건과 오류 없음을 표시하므로, 정상으로 보이는 패널 자체가 AI 보안 서버가 정상이라는 증거는 아닙니다. Failures per minute은 회로 차단기를 작동시키지 않는 네트워크 및 DNS 오류를 포함한 모든 실패를 계산하므로, Circuit breaker tripped가 비어 있는 동안에도 높을 수 있습니다.
AI 보안 서버에 기인하는 지속적인 웹훅 실패는 회로 차단기를 작동시켜 적용을 중지합니다. 서버에 더 이상 연결되지 않으며, Failure handling 선택이 모든 검사 대상 요청에 적용됩니다. Block the request가 선택된 경우 조치를 취할 때까지 조직의 사용자가 차단됩니다. 차단기가 작동하면 관리자에게도 claude.ai 알림 센터를 통해 알림이 전송됩니다.
복구하려면 서버를 수정한 다음 Enforce verdicts를 다시 켜서 차단기를 재설정하세요.
Request signing에서 Rotate secret을 클릭하여 서명 시크릿을 교체하세요. 교체는 즉시 전환됩니다. 새 시크릿이 생성되어 한 번만 표시되고, 이전 시크릿은 더 이상 조회할 수 없으며, 어떤 요청도 두 시크릿 모두로 서명되지 않으므로 의존할 수 있는 중복 기간이 없습니다.
교체 후에도 이전 시크릿으로 서명된 요청이 잠시 도착할 수 있습니다. AI 보안 서버가 전환을 처리하는 방법은 서명 검증에서 다룹니다.
Inference hooks 활동은 조직의 Activity Feed에 기록됩니다: 구성 변경, 거부, 실패 처리 설정에 따라 검사 없이 진행된 요청. 거부 기록에는 각 거부를 자체 시스템의 해당 기록과 연결할 수 있는 식별자가 포함됩니다.
끄기에는 두 가지 수준이 있습니다:
AI 보안 서버 구축: 요청 및 판정 스키마, 서명 검증, 운영 시맨틱.
Inference hooks가 무엇인지, 판정 왕복이 어떻게 작동하는지, AI 보안 서버로 무엇이 전송되는지.
Was this page helpful?