Anthropic ofrece tres niveles de servicio:
El nivel standard es el nivel de servicio predeterminado para todas las solicitudes de API. La API prioriza estas solicitudes junto con todas las demás solicitudes con disponibilidad de mejor esfuerzo.
La API prioriza las solicitudes de este nivel sobre todas las demás solicitudes. Esta priorización ayuda a minimizar los errores de "servidor sobrecargado", incluso durante horas pico.
Para más información, consulta Compromisos existentes del Priority Tier.
Al manejar una solicitud, Anthropic decide asignar una solicitud al Priority Tier en los siguientes escenarios:
Anthropic contabiliza el uso contra la capacidad del Priority Tier de la siguiente manera:
Tokens de entrada
inference_geo: "us") en modelos Claude 4.6 y posteriores, los tokens de entrada son 1.1 tokens por tokenTokens de salida
inference_geo: "us") en modelos Claude 4.6 y posteriores, los tokens de salida son 1.1 tokens por tokenDe lo contrario, las solicitudes proceden en el nivel standard.
Puedes controlar qué niveles de servicio se pueden usar para una solicitud configurando el parámetro service_tier:
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-opus-4-8",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello, Claude!"}],
service_tier="auto", # Automatically use Priority Tier when available, fallback to standard
)
print(message.usage.service_tier)El parámetro service_tier acepta los siguientes valores:
"auto" (predeterminado) - Usa la capacidad del Priority Tier si está disponible, recurriendo a tu otra capacidad si no lo está"standard_only" - Solo usa la capacidad del nivel standard, útil si no quieres usar tu capacidad del Priority TierEl objeto usage de la respuesta también incluye el nivel de servicio asignado a la solicitud:
{
"usage": {
"input_tokens": 410,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0,
"output_tokens": 585,
"service_tier": "priority"
}
}Esto te permite determinar qué nivel de servicio se asignó a la solicitud.
Al solicitar service_tier="auto" con un modelo con un compromiso de Priority Tier, estos encabezados de respuesta proporcionan información:
anthropic-priority-input-tokens-limit: 10000
anthropic-priority-input-tokens-remaining: 9618
anthropic-priority-input-tokens-reset: 2025-01-12T23:11:59Z
anthropic-priority-output-tokens-limit: 10000
anthropic-priority-output-tokens-remaining: 6000
anthropic-priority-output-tokens-reset: 2025-01-12T23:12:21ZPuedes usar la presencia de estos encabezados para detectar si tu solicitud era elegible para el Priority Tier, incluso si estaba por encima del límite.
Un compromiso de Priority Tier consiste en:
El Priority Tier tiene como objetivo un 99.5% de tiempo de actividad con recursos computacionales priorizados. Las solicitudes que exceden tu capacidad comprometida recurren automáticamente al nivel standard.
El Priority Tier es compatible con todos los modelos de Claude disponibles excepto Claude Mythos 5, Claude Mythos Preview, Claude Opus 5 y Claude Sonnet 5.
Consulta la descripción general de modelos para más detalles sobre los modelos disponibles.
Was this page helpful?