Los "Inference hooks" (hooks de inferencia) envían los prompts de tu organización a un servidor de seguridad de IA que tú elijas, y retienen cada solicitud hasta recibir un veredicto de permitir o denegar antes de que Claude la procese. Esta página te guía para activar la función, conectar tu servidor y controlar la aplicación. Para saber qué son los Inference hooks y cuándo usarlos, consulta la descripción general de Inference hooks. Para construir el servidor de seguridad de IA en sí, consulta Desarrollar una integración de Inference hooks.
Necesitas:
organization:manage en claude.ai. Los roles integrados Admin, Owner y Primary owner lo poseen, así como cualquier rol personalizado al que se le haya otorgado.https:// en el puerto 443, en un host enrutable públicamente, accesible sin redirecciones. Para conocer los requisitos de alojamiento completos, y para construir el servidor y verificar las solicitudes firmadas, consulta Desarrollar una integración de Inference hooks.Hay tres estados de aplicación: desactivado (Enforce verdicts está desactivado: nunca se contacta a tu servidor de seguridad de IA y los prompts no se inspeccionan), shadow (Enforce verdicts está activado con Mode configurado en Shadow mode: tu servidor de seguridad de IA recibe prompts y devuelve veredictos, y nada se bloquea), y aplicando (Enforce verdicts está activado con Mode configurado en Allow the request o Block the request: una denegación bloquea la solicitud). Los siguientes pasos llevan una nueva configuración desde desactivado hasta aplicando.
Permitir Inference hooks para tu organización
Ve a claude.ai > Organization settings > Data and privacy y busca la sección Inference hooks. Activa Allow for your organization.
Activar esto desbloquea la página de configuración de Inference hooks y siempre fuerza Enforce verdicts a desactivado, por lo que permitir la función nunca inicia la inspección por sí sola: incluso una configuración que anteriormente tenía la aplicación activada permanece sin inspección hasta que vuelvas a activar Enforce verdicts en el paso final.
Abrir la página de configuración de Inference hooks
Aún en Data and privacy, abre la sección Inference hooks para llegar a la página de configuración de Inference hooks. Se encuentra dentro de Data and privacy en lugar de como una entrada propia en la navegación de configuración, por lo que su ruta de navegación muestra Data and privacy / Inference hooks. Hasta que guardes un endpoint, la página advierte que los prompts aún no se están inspeccionando, y Enforce verdicts permanece desactivado con una insignia Requires endpoint.
Configurar tu endpoint
Haz clic en Configure para abrir el cuadro de diálogo Configure endpoint y completa:
https:// que recibe las solicitudes de veredicto. Solo se aceptan URLs https://.- en lugar de _, y no deben coincidir con nombres reservados (encabezados de estructura de solicitud como Content-* y Host, encabezados de proxy y cookies, encabezados de dirección del cliente como X-Forwarded-*, los encabezados de firma webhook-* y el prefijo X-Anthropic-*). Los valores deben ser ASCII imprimible.El cuadro de diálogo cubre solo esos dos campos más Test connection; no pregunta sobre el manejo de fallos, que eliges en el paso 6. Una vez que se guarda un endpoint, el botón muestra Edit.
Probar la conexión
Haz clic en Test connection. Claude envía un prompt de prueba sintético a la URL y los encabezados que están actualmente en el formulario, no a los valores guardados, así que vuelve a ingresar cualquier valor de encabezado almacenado antes de probar. Si tiene éxito, el resultado informa si tu servidor de seguridad de IA devolvió un veredicto de permitir o denegar para el prompt de prueba, lo que revela un valor predeterminado de denegar todo antes de que comiences a aplicar.
Resultados de fallo comunes:
| Resultado | Qué verificar |
|---|---|
| URL rejected | La URL falló una verificación estructural. Usa una URL https:// en el puerto 443. |
| Private or internal IP | El host se resuelve a una dirección privada o interna. Usa un host enrutable públicamente. |
| Timeout | El servidor de seguridad de IA no devolvió un veredicto dentro del tiempo de espera. |
| Transport error | La resolución DNS, el handshake TLS o la conexión fallaron. |
| Non-200 status | El servidor de seguridad de IA respondió con un estado distinto de 200. Los veredictos deben regresar como HTTP 200; las redirecciones no se siguen y cuentan como fallos. |
| Unparseable response | El servidor de seguridad de IA respondió, pero el cuerpo no es un veredicto válido. |
Guardar y almacenar tu secreto de firma
Guarda la configuración del endpoint. El primer guardado genera tu secreto de firma de webhook y lo revela una sola vez. Cópialo y almacénalo de forma segura antes de cerrar el cuadro de diálogo: el secreto no se puede recuperar más tarde, solo rotar.
Tu servidor de seguridad de IA usa este secreto para verificar la firma en cada solicitud que recibe. Para el procedimiento de verificación, consulta Verificar la firma.
Elegir el manejo de fallos y el tiempo de espera
En Failure handling, configura Mode para elegir qué sucede cuando el servidor de seguridad de IA no está disponible o los veredictos agotan el tiempo de espera:
La tercera opción del menú desplegable, Shadow mode, es una herramienta de despliegue en lugar de una política de fallos; consulta Shadow mode.
Luego configura Prompt verdict timeout (ms): de 1 a 10,000 ms, con un valor predeterminado de 5,000 ms. El presupuesto cubre todo el intercambio, y un veredicto más lento cuenta como un servidor inaccesible, así que establece el valor más bajo que tu servidor pueda cumplir de manera confiable.
Los cambios en esta sección se guardan a medida que los realizas. En el primer guardado, los valores predeterminados son Allow the request y 5,000 ms.
Elegir un porcentaje de despliegue
En Rollout, configura Requests inspected (%) para ejecutar la inspección en un porcentaje de solicitudes mientras pones en marcha tu servidor de seguridad de IA. El valor va de 0 a 100: 100 inspecciona todo, y 0 desactiva la inspección.
Cada solicitud se sortea una vez para todo su turno de conversación, por lo que una sola conversación puede ser inspeccionada parcialmente a lo largo de los turnos. Las solicitudes fuera del porcentaje muestreado proceden sin inspección, incluso cuando el manejo de fallos está configurado en Block the request.
Activar Enforce verdicts
Para evaluar veredictos contra tráfico en vivo sin bloquear a nadie al principio, configura Mode en Shadow mode (paso 6) antes de activar la aplicación; consulta Shadow mode.
Activa Enforce verdicts para condicionar Claude al veredicto de tu servidor de seguridad de IA para cada prompt gobernado, luego confirma en el cuadro de diálogo, que reitera tu elección de manejo de fallos. Espera aproximadamente un minuto para que el cambio llegue a todos los servidores de Anthropic; las solicitudes que ya están en curso terminan bajo la configuración anterior. Desactivarlo detiene el envío de prompts a tu servidor de seguridad de IA, nuevamente en aproximadamente un minuto; tu configuración se conserva.
El "shadow mode" (modo sombra) ejecuta tu hook contra tráfico en vivo sin bloquear nada. Tu servidor de seguridad de IA recibe prompts gobernados y devuelve veredictos exactamente como lo haría al aplicar, pero nada se bloquea: cada solicitud procede al modelo, incluso cuando tu servidor la deniega o no se puede contactar, y el usuario final no ve nada. Úsalo para ajustar tu política contra el tráfico real de tu organización antes de comenzar a aplicar.
Para usar shadow mode, configura Mode en Shadow mode bajo Failure handling, luego activa Enforce verdicts para que los prompts fluyan a tu servidor de seguridad de IA. Mientras está activo, la página de configuración muestra una insignia Shadow mode — not blocking. Para salir de shadow mode, vuelve a configurar Mode en Allow the request o Block the request; los veredictos se aplican nuevamente una vez que la aplicación está activada.
En Exclusions, selecciona roles cuyos miembros no están cubiertos por Inference hooks: sus prompts nunca se envían a tu servidor de seguridad de IA. Solo se pueden excluir los roles personalizados que tu organización creó; los roles integrados no se ofrecen. Selecciónalos en el selector de roles, cuyo texto de marcador de posición dice Select roles to exclude, y administra quién tiene cada rol desde la página de administración de roles (Manage roles); cambiar las exclusiones requiere permiso de gestión de identidad. La lista está vacía de forma predeterminada, y sin roles excluidos, cada solicitud gobernada se inspecciona.
La exclusión se aplica a las sesiones interactivas de un usuario; el tráfico autenticado por credenciales de máquina siempre se inspecciona. Si Claude no puede resolver la pertenencia a roles de un solicitante, la solicitud falla de forma cerrada con un error reintentable en lugar de proceder sin inspección. Los cambios en la lista de exclusiones se registran en el registro de auditoría.
En Custom blocked prompt message, establece un texto personalizado de hasta 500 caracteres que se añade al error que ve un usuario final cuando tu servidor de seguridad de IA deniega una solicitud (normalmente a quién contactar o dónde solicitar una excepción). El mensaje final es el deny_reason por solicitud de tu servidor de seguridad de IA (cuando está presente), una línea en blanco, y luego este texto. Sin texto personalizado configurado, un valor predeterminado integrado indica al usuario que contacte a sus administradores; también puedes desactivar por completo el mensaje añadido para que el usuario vea solo el deny_reason.
El área de estado del endpoint de la página de configuración de Inference hooks muestra:
El panel es de mejor esfuerzo: si Anthropic no puede leer los contadores, muestra cero fallos y ningún error en lugar de un error propio, por lo que un panel que parece saludable no es por sí solo prueba de que tu servidor de seguridad de IA está saludable. Failures per minute cuenta cada fallo, incluidos los errores de red y DNS que nunca activan el interruptor de circuito, por lo que puede ser alto mientras Circuit breaker tripped permanece vacío.
Los fallos sostenidos de webhook atribuibles a tu servidor de seguridad de IA activan el "circuit breaker" (interruptor de circuito), que detiene la aplicación: ya no se contacta a tu servidor, y tu elección de Failure handling se aplica a cada solicitud inspeccionada. Con Block the request seleccionado, los usuarios de tu organización quedan bloqueados hasta que actúes. Cuando el interruptor se activa, los administradores también son notificados en el centro de notificaciones de claude.ai.
Para recuperarte, arregla el servidor, luego vuelve a activar Enforce verdicts para restablecer el interruptor.
Haz clic en Rotate secret bajo Request signing para reemplazar tu secreto de firma. La rotación es un cambio inmediato: el nuevo secreto se genera y se revela una sola vez, el secreto anterior ya no se puede recuperar, y ninguna solicitud se firma jamás con ambos secretos, por lo que no hay un período de superposición en el que confiar.
Las solicitudes firmadas con el secreto anterior aún pueden llegar brevemente después de la rotación; Verificar la firma cubre cómo tu servidor de seguridad de IA debe manejar el cambio.
La actividad de Inference hooks se registra en el Activity Feed de tu organización: cambios de configuración, denegaciones y solicitudes que procedieron sin inspección bajo tu configuración de manejo de fallos. Los registros de denegación llevan identificadores que te permiten unir cada denegación con el registro correspondiente en tu propio sistema.
Hay dos niveles de desactivación:
Construye el servidor de seguridad de IA: los esquemas de solicitud y veredicto, la verificación de firma y la semántica operativa.
Qué son los Inference hooks, cómo funciona el ciclo de ida y vuelta del veredicto, y qué se envía a tu servidor de seguridad de IA.
Was this page helpful?