Anthropic menawarkan tiga tingkat layanan:
Tingkat standard adalah tingkat layanan default untuk semua permintaan API. API memprioritaskan permintaan ini bersama semua permintaan lainnya dengan ketersediaan upaya terbaik (best-effort).
API memprioritaskan permintaan di tingkat ini di atas semua permintaan lainnya. Prioritisasi ini membantu meminimalkan kesalahan "server overloaded", bahkan selama waktu puncak.
Untuk informasi lebih lanjut, lihat Komitmen Priority Tier yang sudah ada.
Saat menangani permintaan, Anthropic memutuskan untuk menetapkan permintaan ke Priority Tier dalam skenario berikut:
Anthropic menghitung penggunaan terhadap kapasitas Priority Tier sebagai berikut:
Token input
inference_geo: "us") pada model Claude 4.6 dan yang lebih baru, token input dihitung sebagai 1,1 token per tokenToken output
inference_geo: "us") pada model Claude 4.6 dan yang lebih baru, token output dihitung sebagai 1,1 token per tokenJika tidak, permintaan diproses pada tingkat standard.
Anda dapat mengontrol tingkat layanan mana yang dapat digunakan untuk sebuah permintaan dengan mengatur parameter service_tier:
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-opus-4-8",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello, Claude!"}],
service_tier="auto", # Automatically use Priority Tier when available, fallback to standard
)
print(message.usage.service_tier)Parameter service_tier menerima nilai-nilai berikut:
"auto" (default) - Menggunakan kapasitas Priority Tier jika tersedia, dan beralih ke kapasitas Anda yang lain jika tidak"standard_only" - Hanya menggunakan kapasitas tingkat standard, berguna jika Anda tidak ingin menggunakan kapasitas Priority Tier AndaObjek usage pada respons juga menyertakan tingkat layanan yang ditetapkan untuk permintaan tersebut:
{
"usage": {
"input_tokens": 410,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0,
"output_tokens": 585,
"service_tier": "priority"
}
}Ini memungkinkan Anda menentukan tingkat layanan mana yang ditetapkan untuk permintaan tersebut.
Saat meminta service_tier="auto" dengan model yang memiliki komitmen Priority Tier, header respons berikut memberikan wawasan:
anthropic-priority-input-tokens-limit: 10000
anthropic-priority-input-tokens-remaining: 9618
anthropic-priority-input-tokens-reset: 2025-01-12T23:11:59Z
anthropic-priority-output-tokens-limit: 10000
anthropic-priority-output-tokens-remaining: 6000
anthropic-priority-output-tokens-reset: 2025-01-12T23:12:21ZAnda dapat menggunakan keberadaan header ini untuk mendeteksi apakah permintaan Anda memenuhi syarat untuk Priority Tier, bahkan jika sudah melebihi batas.
Komitmen Priority Tier terdiri dari:
Priority Tier menargetkan uptime 99,5% dengan sumber daya komputasi yang diprioritaskan. Permintaan di luar kapasitas yang Anda komitmenkan secara otomatis beralih ke tingkat standard.
Priority Tier didukung pada semua model Claude yang tersedia kecuali Claude Mythos 5, Claude Mythos Preview, Claude Opus 5, dan Claude Sonnet 5.
Lihat Ikhtisar model untuk detail lebih lanjut tentang model yang tersedia.
Was this page helpful?