El conteo de tokens te permite determinar el número de tokens en un mensaje antes de enviarlo a Claude. Esto te ayuda a tomar decisiones informadas sobre tus prompts y tu uso. Con el conteo de tokens, puedes:
El endpoint de conteo de tokens acepta la misma lista estructurada de entradas que se usa para crear un mensaje, incluyendo compatibilidad con indicaciones del sistema, herramientas, imágenes y PDFs. La respuesta contiene el número total de tokens de entrada.
Todos los modelos activos admiten el conteo de tokens, incluidos Claude Opus 5 y Claude Sonnet 5.
client = anthropic.Anthropic()
response = client.messages.count_tokens(
model="claude-opus-5",
system="You are a scientist",
messages=[{"role": "user", "content": "Hello, Claude"}],
)
print(response.json()){ "input_tokens": 14 }client = anthropic.Anthropic()
response = client.messages.count_tokens(
model="claude-opus-5",
tools=[
{
"name": "get_weather",
"description": "Get the current weather in a given location",
"input_schema": {
"type": "object",
"properties": {
"location": {
"type": "string",
"description": "The city and state, e.g. San Francisco, CA",
}
},
"required": ["location"],
},
}
],
messages=[{"role": "user", "content": "What's the weather like in San Francisco?"}],
)
print(response.json()){ "input_tokens": 403 }import base64
import httpx
image_url = "https://platform.claude.com/docs/images/vision-example.jpg"
image_media_type = "image/jpeg"
image_data = base64.standard_b64encode(httpx.get(image_url).content).decode("utf-8")
client = anthropic.Anthropic()
response = client.messages.count_tokens(
model="claude-opus-5",
messages=[
{
"role": "user",
"content": [
{
"type": "image",
"source": {
"type": "base64",
"media_type": image_media_type,
"data": image_data,
},
},
{"type": "text", "text": "Describe this image"},
],
}
],
)
print(response.json()){ "input_tokens": 1028 }client = anthropic.Anthropic()
response = client.messages.count_tokens(
model="claude-sonnet-4-6",
thinking={"type": "enabled", "budget_tokens": 16000},
messages=[
{
"role": "user",
"content": "Are there an infinite number of prime numbers such that n mod 4 == 3?",
},
{
"role": "assistant",
"content": [
{
"type": "thinking",
"thinking": "This is a nice number theory question. Let's think about it step by step...",
"signature": "EuYBCkQYAiJAgCs1le6/Pol5Z4/JMomVOouGrWdhYNsH3ukzUECbB6iWrSQtsQuRHJID6lWV...",
},
{
"type": "text",
"text": "Yes, there are infinitely many prime numbers p such that p mod 4 = 3...",
},
],
},
{"role": "user", "content": "Can you write a formal proof?"},
],
)
print(response.json()){ "input_tokens": 88 }import base64
import anthropic
client = anthropic.Anthropic()
with open("/path/to/document.pdf", "rb") as pdf_file:
pdf_base64 = base64.standard_b64encode(pdf_file.read()).decode("utf-8")
response = client.messages.count_tokens(
model="claude-opus-5",
messages=[
{
"role": "user",
"content": [
{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": pdf_base64,
},
},
{"type": "text", "text": "Please summarize this document."},
],
}
],
)
print(response.json()){ "input_tokens": 2188 }Claude Fable 5 y Claude Mythos 5 usan el tokenizador introducido con Claude Opus 4.7, que produce aproximadamente un 30 por ciento más de tokens que los modelos anteriores a Claude Opus 4.7 para el mismo texto. El aumento exacto depende del contenido y la forma de la carga de trabajo. El endpoint de conteo de tokens devuelve el conteo según el tokenizador del model que pases, así que para medir la diferencia en tu carga de trabajo, cuenta la misma solicitud dos veces: una con tu modelo actual y otra con model: "claude-fable-5" (o "claude-mythos-5"), y compara los dos valores de input_tokens.
El conteo de tokens es gratuito, pero está sujeto a límites de velocidad de solicitudes por minuto según tu nivel de uso. Si necesitas límites más altos, usa Request rate limit increase en la página de Rate limits.
| Nivel de uso | Solicitudes por minuto (RPM) |
|---|---|
| Start | 2,000 |
| Build | 4,000 |
| Scale | 8,000 |
Lee la referencia completa de la API para el endpoint de conteo de tokens.
Usa los conteos de tokens para mantener los prompts dentro de la ventana de contexto de un modelo.
Verifica los conteos de tokens antes de enviar una solicitud para mantenerte dentro de tu nivel de uso.
Reduce el costo y la latencia en prompts repetidos almacenando en caché los prefijos de los prompts.
| Supported platforms |
|
|---|
Was this page helpful?