Los "Inference hooks" (hooks de inferencia) permiten que una organización de Claude Enterprise enrute cada prompt gobernado a través de un servidor de seguridad de IA, un servicio HTTPS que opera la organización o su proveedor de seguridad, antes de que se ejecute la inferencia. Cuando un usuario envía un prompt, Anthropic envía la transcripción de la conversación a tu servidor de seguridad de IA y espera un veredicto de permitir o denegar; una solicitud denegada nunca llega al modelo. Los equipos de seguridad y cumplimiento usan los Inference hooks para aplicar políticas de datos en línea, y los desarrolladores construyen el servidor de seguridad de IA que evalúa cada solicitud.
Debido a que el hook se ejecuta en los servidores de Anthropic, después de que la solicitud sale del cliente y antes de que se ejecute el modelo, se aplica de manera uniforme a cada solicitud gobernada, sin nada que instalar o desplegar en los dispositivos de los usuarios.
Actualmente, el único evento de hook es prompt, que se activa una vez por cada solicitud de inferencia gobernada, antes de que comience la inferencia. La aplicación del lado de la respuesta está planificada como un evento posterior.
POST HTTPS al endpoint del servidor de seguridad de IA configurado por tu organización. El cuerpo de la solicitud contiene la transcripción de la conversación, y cada solicitud se firma según la especificación de Standard Webhooks una vez que tu organización genera su secreto de firma, de modo que tu servidor pueda verificar que provino de Anthropic.allow, la inferencia procede normalmente. Con deny, la solicitud se rechaza y el usuario ve un mensaje de bloqueo por política compuesto de dos partes: la razón específica de la solicitud que tu servidor de seguridad de IA proporcionó en el campo deny_reason del veredicto, seguida de un mensaje permanente que configuran tus administradores (por ejemplo, a quién contactar o dónde solicitar una excepción). Si tus administradores no han configurado uno, un mensaje predeterminado integrado indica al usuario que los contacte. Cada denegación también se registra en el Activity Feed de tu organización.El siguiente diagrama traza un ejemplo (una solicitud de Cowork donde Claude también llama a una herramienta de O365) para ilustrar qué partes del flujo tienen hooks. Los puntos con hooks son los pasos 1 y 5 del diagrama, donde llega el prompt y regresa el resultado de la herramienta; cada uno resulta en el intercambio de validación con tu servidor de seguridad de IA que se muestra en los pasos 2 y 6.
Un veredicto es un pequeño objeto JSON: {"action": "allow"} permite que la solicitud proceda, y una denegación incluye la razón que se muestra al usuario. Para el esquema completo del veredicto, consulta Devolver un veredicto.
Tu servidor de seguridad de IA ve lo que ve el usuario: texto de la transcripción, llamadas a herramientas y sus resultados, y texto extraído de los archivos adjuntos. Nunca recibe bytes sin procesar de archivos o imágenes, indicaciones del sistema ni contexto interno de Anthropic.
Si tu servidor de seguridad de IA no está disponible, devuelve un error o no responde dentro del tiempo de espera, la configuración de manejo de fallos de tu organización decide el resultado: bloquear la solicitud o permitir que proceda sin inspección.
La aplicación puede implementarse a tu ritmo, de modo que nadie tenga que ser bloqueado desde el primer día: el modo sombra observa los veredictos en el tráfico en vivo sin bloquear nada, un porcentaje de despliegue inspecciona una fracción elegida de solicitudes, y las exclusiones eximen por completo a los miembros de los roles elegidos. Consulta Configurar Inference hooks.
Para los esquemas completos de solicitud y respuesta, la verificación de firmas y los detalles operativos, consulta Desarrollar una integración.
allow, como una alternativa basada en push al sondeo de la Compliance API.Los Inference hooks están disponibles para organizaciones de Claude Enterprise. Configurarlos requiere el permiso organization:manage, que poseen los roles integrados de Admin, Owner y Primary owner, así como cualquier rol personalizado al que se le haya otorgado.
Un solo hook gobierna las conversaciones en claude.ai, Cowork y las sesiones de Claude Code en tu organización de Claude Enterprise, ya sea que se ejecuten en la web, en la aplicación de escritorio o en la CLI. Los Inference hooks no están disponibles en Amazon Bedrock ni en Google Cloud.
Las solicitudes gobernadas son las solicitudes de inferencia detrás de la conversación del usuario. Las solicitudes auxiliares, como la generación de títulos de conversación, no se envían a tu endpoint, y las indicaciones del sistema y las definiciones de herramientas nunca se incluyen en lo que se envía. El modo de voz no está cubierto.
Ambas funcionalidades sirven a los equipos de seguridad, legales y de cumplimiento en organizaciones de Claude Enterprise.
| Inference hooks | Compliance API | |
|---|---|---|
| Cuándo actúa | En línea, antes de que se ejecute la inferencia | Después del hecho |
| Qué hace | Permite o deniega cada solicitud gobernada en tiempo real | Recupera actividad, chats, archivos, proyectos, transcripciones de sesiones de Cowork y Claude Code, y usuarios para auditoría y exportación |
| Dirección | Anthropic llama a tu servidor de seguridad de IA | Tú llamas a la API de Anthropic |
Usa los Inference hooks para detener una solicitud antes de que llegue al modelo, y la Compliance API para auditar lo que sucedió después.
Habilita los Inference hooks para tu organización, configura y prueba tu servidor de seguridad de IA, elige el manejo de fallos y aplica los veredictos.
Los esquemas de solicitud y veredicto, la verificación de firmas, la semántica operativa y los patrones de integración para construir el servidor de seguridad de IA.
Was this page helpful?