Halaman ini menyediakan informasi harga terperinci untuk model dan fitur Anthropic. Semua harga dalam USD.
Untuk informasi harga terkini, kunjungi claude.com/pricing.
Tabel berikut menunjukkan harga untuk semua model Claude:
| Model | Token Input Dasar | Penulisan Cache 5m | Penulisan Cache 1j | Cache Hit & Refresh | Token Output |
|---|---|---|---|---|---|
| Claude Fable 5 | $10 / MTok | $12,50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Mythos 5 (ketersediaan terbatas) | $10 / MTok | $12,50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Opus 5 | $5 / MTok | $6,25 / MTok | $10 / MTok | $0,50 / MTok | $25 / MTok |
| Claude Opus 4.8 | $5 / MTok | $6,25 / MTok | $10 / MTok | $0,50 / MTok | $25 / MTok |
| Claude Opus 4.7 | $5 / MTok | $6,25 / MTok | $10 / MTok | $0,50 / MTok | $25 / MTok |
| Claude Opus 4.6 | $5 / MTok | $6,25 / MTok | $10 / MTok | $0,50 / MTok | $25 / MTok |
| Claude Opus 4.5 | $5 / MTok | $6,25 / MTok | $10 / MTok | $0,50 / MTok | $25 / MTok |
| Claude Opus 4.1 (dihentikan, kecuali di Bedrock dan Google Cloud) | $15 / MTok | $18,75 / MTok | $30 / MTok | $1,50 / MTok | $75 / MTok |
| Claude Opus 4 (dihentikan, kecuali di Google Cloud) | $15 / MTok | $18,75 / MTok | $30 / MTok | $1,50 / MTok | $75 / MTok |
| Claude Sonnet 5 | $2 / MTok | $2,50 / MTok | $4 / MTok | $0,20 / MTok | $10 / MTok |
| Claude Sonnet 4.6 | $3 / MTok | $3,75 / MTok | $6 / MTok | $0,30 / MTok | $15 / MTok |
| Claude Sonnet 4.5 | $3 / MTok | $3,75 / MTok | $6 / MTok | $0,30 / MTok | $15 / MTok |
| Claude Sonnet 4 (dihentikan, kecuali di Bedrock dan Google Cloud) | $3 / MTok | $3,75 / MTok | $6 / MTok | $0,30 / MTok | $15 / MTok |
| Claude Haiku 4.5 | $1 / MTok | $1,25 / MTok | $2 / MTok | $0,10 / MTok | $5 / MTok |
| Claude Haiku 3.5 (dihentikan, kecuali di Bedrock dan Google Cloud) | $0,80 / MTok | $1 / MTok | $1,60 / MTok | $0,08 / MTok | $4 / MTok |
Untuk harga Claude Platform on AWS, lihat Harga Claude Platform on AWS.
Bagian ini mencakup platform cloud yang dioperasikan mitra, di mana penyedia cloud menagih Anda. Untuk platform cloud yang dioperasikan Anthropic dan ditagih melalui marketplace, lihat Harga Claude Platform on AWS dan Harga Claude di Microsoft Foundry.
Model Claude tersedia di Amazon Bedrock dan Google Cloud. Untuk harga resmi, kunjungi:
Claude Platform on AWS menagih melalui AWS Marketplace menggunakan Claude Consumption Units (CCU). Anthropic menghitung penggunaan token Anda dalam USD dengan tarif standar per model, per fitur, menerapkan diskon yang dinegosiasikan, mengonversi hasilnya ke CCU dengan tarif $0,01 per CCU, dan melaporkan jumlah CCU ke AWS Marketplace setiap jam. Tagihan AWS Anda menampilkan satu item baris CCU.
| Konsep | Detail |
|---|---|
| Unit penagihan | Claude Consumption Unit (CCU) |
| Harga CCU | $0,01 per CCU (tetap; diskon diterapkan pada konversi token-ke-CCU, bukan pada harga CCU) |
| Konversi | Penggunaan token dihitung dalam USD dengan tarif standar per model, per fitur (sama dengan harga Claude API), kemudian dikonversi ke CCU dengan tarif $0,01 per CCU |
| Frekuensi penagihan | Pengukuran per jam ke AWS Marketplace; faktur bulanan |
| Model pembayaran | Hanya pascabayar (postpaid); tidak ada kredit prabayar |
| Diskon | Diterapkan sebagai lebih sedikit CCU yang diukur |
| Pajak | Pengukuran sebelum pajak; AWS Marketplace menangani pajak |
| Visibilitas biaya | Rincian real-time di Claude Console (akses melalui AWS Console); AWS Cost Explorer menampilkan CCU agregat |
Untuk model Claude 4.6 dan yang lebih baru, menggunakan inference_geo: "us" menerapkan pengali harga 1,1x. inference_geo: "global" (default) menggunakan harga standar. Lihat Residensi data untuk detailnya.
Saat Anda mendaftar di halaman layanan Claude Platform on AWS di AWS Console, AWS Console mencari penawaran privat apa pun yang terkait dengan akun Anda dan meminta Anda untuk menerimanya di AWS Marketplace. Hubungi perwakilan akun Anthropic Anda untuk ketentuan penawaran privat.
Claude di Microsoft Foundry menagih melalui Azure Marketplace menggunakan Claude Consumption Units (CCU). Anthropic menghitung penggunaan token Anda dalam USD dengan tarif standar per model, per fitur, menerapkan diskon yang dinegosiasikan, mengonversi hasilnya ke CCU dengan tarif $0,01 per CCU, dan melaporkan jumlah CCU ke Azure Marketplace setiap jam. Tagihan Azure Anda menampilkan satu item baris CCU.
| Konsep | Detail |
|---|---|
| Unit penagihan | Claude Consumption Unit (CCU) |
| Harga CCU | $0,01 per CCU (tetap; diskon diterapkan pada konversi token-ke-CCU, bukan pada harga CCU) |
| Konversi | Penggunaan token dihitung dalam USD dengan tarif standar per model, per fitur (sama dengan harga Claude API), kemudian dikonversi ke CCU dengan tarif $0,01 per CCU |
| Frekuensi penagihan | Pengukuran per jam ke Azure Marketplace; faktur bulanan |
| Model pembayaran | Hanya pascabayar (postpaid); tidak ada kredit prabayar |
| Diskon | Diterapkan sebagai lebih sedikit CCU yang diukur |
| Pajak | Pengukuran sebelum pajak; Azure Marketplace menangani pajak |
| Visibilitas biaya | Azure Cost Management menampilkan CCU agregat |
Deployment yang di-host di Azure dapat menggunakan jenis deployment US Data Zone Standard, yang menjaga inferensi tetap berada di Amerika Serikat. Ini setara dengan inference_geo: "us" pada Claude API dan menerapkan pengali harga 1,1x yang sama. Lihat Residensi data untuk detailnya.
"Prompt caching" (caching prompt) mengurangi biaya dan latensi dengan menggunakan kembali bagian prompt Anda yang telah diproses sebelumnya di seluruh panggilan API. Alih-alih memproses ulang prompt sistem besar, dokumen, atau riwayat percakapan yang sama pada setiap permintaan, API membaca dari cache dengan sebagian kecil dari harga input standar.
Ada dua cara untuk mengaktifkan caching prompt:
cache_control di tingkat atas permintaan Anda. Sistem secara otomatis mengelola breakpoint cache seiring berkembangnya percakapan. Ini adalah titik awal yang direkomendasikan untuk sebagian besar kasus penggunaan.cache_control langsung pada blok konten individual untuk kontrol yang lebih terperinci atas apa yang di-cache.Caching prompt menggunakan pengali harga berikut relatif terhadap tarif token input dasar:
| Operasi cache | Pengali | Durasi |
|---|---|---|
| Penulisan cache 5 menit | 1,25x harga input dasar | Cache berlaku selama 5 menit |
| Penulisan cache 1 jam | 2x harga input dasar | Cache berlaku selama 1 jam |
| Pembacaan cache (hit) | 0,1x harga input dasar | Durasi sama dengan penulisan sebelumnya |
Token penulisan cache dikenakan biaya saat konten pertama kali disimpan. Token pembacaan cache dikenakan biaya saat permintaan berikutnya mengambil konten yang di-cache. Cache hit berbiaya 10% dari harga input standar, yang berarti caching menjadi menguntungkan setelah satu pembacaan cache untuk durasi 5 menit (penulisan 1,25x), atau setelah dua pembacaan cache untuk durasi 1 jam (penulisan 2x).
Pengali ini dapat digabungkan dengan pengubah harga lainnya, termasuk diskon Batch API dan residensi data.
Untuk detail implementasi, model yang didukung, dan contoh kode, lihat Caching prompt.
Untuk model Claude 4.6 dan yang lebih baru, menentukan inferensi khusus AS melalui parameter inference_geo dikenakan pengali 1,1x pada semua kategori harga token, termasuk token input, token output, penulisan cache, dan pembacaan cache. Routing global (default) menggunakan harga standar.
Ini berlaku untuk Claude API (pihak pertama) dan Claude Platform on AWS. Pada Claude di Microsoft Foundry, pengali 1,1x yang sama berlaku untuk deployment yang menggunakan jenis deployment US Data Zone Standard (lihat Geografi inferensi). Platform yang dioperasikan mitra (Bedrock dan Google Cloud) memiliki harga regional independen. Lihat Bedrock dan Google Cloud untuk detailnya. Model sebelumnya tidak mendukung parameter inference_geo dan selalu menggunakan harga standar; permintaan yang menyertakan parameter tersebut pada model ini mengembalikan error 400.
Untuk informasi lebih lanjut, lihat Residensi data.
Mode cepat, dalam pratinjau riset, menyediakan output yang jauh lebih cepat untuk Claude Opus 5 dan Claude Opus 4.8 dengan harga premium. Harga mode cepat berlaku di seluruh jendela konteks penuh, termasuk permintaan dengan lebih dari 200k token input. Mode cepat hanya tersedia di Claude API (pihak pertama); tidak tersedia di Claude Platform on AWS atau platform cloud yang dioperasikan mitra.
| Model | Input | Output |
|---|---|---|
| Claude Opus 5 / Claude Opus 4.8 | $10 / MTok | $50 / MTok |
Mode cepat tidak tersedia di Claude Opus 4.7 (permintaan dengan speed: "fast" mengembalikan error) atau Claude Opus 4.6 (permintaan berjalan dengan kecepatan standar dan ditagih dengan tarif standar). Lihat Mode cepat.
Harga mode cepat dapat digabungkan dengan pengubah harga lainnya:
Mode cepat tidak tersedia dengan Batch API.
Untuk informasi lebih lanjut, lihat Mode cepat.
Batch API memungkinkan pemrosesan asinkron untuk volume permintaan yang besar dengan diskon 50% pada token input dan output.
| Model | Input batch | Output batch |
|---|---|---|
| Claude Fable 5 | $5 / MTok | $25 / MTok |
| Claude Mythos 5 (ketersediaan terbatas) | $5 / MTok | $25 / MTok |
| Claude Opus 5 | $2,50 / MTok | $12,50 / MTok |
| Claude Opus 4.8 | $2,50 / MTok | $12,50 / MTok |
| Claude Opus 4.7 | $2,50 / MTok | $12,50 / MTok |
| Claude Opus 4.6 | $2,50 / MTok | $12,50 / MTok |
| Claude Opus 4.5 | $2,50 / MTok | $12,50 / MTok |
| Claude Opus 4.1 (dihentikan, kecuali di Bedrock dan Google Cloud) | $7,50 / MTok | $37,50 / MTok |
| Claude Opus 4 (dihentikan, kecuali di Google Cloud) | $7,50 / MTok | $37,50 / MTok |
| Claude Sonnet 5 | $1 / MTok | $5 / MTok |
| Claude Sonnet 4.6 | $1,50 / MTok | $7,50 / MTok |
| Claude Sonnet 4.5 | $1,50 / MTok | $7,50 / MTok |
| Claude Sonnet 4 (dihentikan, kecuali di Bedrock dan Google Cloud) | $1,50 / MTok | $7,50 / MTok |
| Claude Haiku 4.5 | $0,50 / MTok | $2,50 / MTok |
| Claude Haiku 3.5 (dihentikan, kecuali di Bedrock dan Google Cloud) | $0,40 / MTok | $2 / MTok |
Untuk informasi lebih lanjut tentang pemrosesan batch, lihat Pemrosesan batch.
Model Claude 4.6 dan yang lebih baru serta Claude Mythos Preview menyertakan jendela konteks 1 juta token penuh dengan harga standar. (Permintaan 900k token ditagih dengan tarif per token yang sama dengan permintaan 9k token.) Diskon caching prompt dan pemrosesan batch berlaku dengan tarif standar di seluruh jendela konteks penuh.
Permintaan "tool use" (penggunaan alat) dikenakan biaya berdasarkan:
tools)Alat sisi klien dikenakan biaya sama seperti permintaan API Claude lainnya, meskipun alat sisi server dapat menimbulkan biaya tambahan berdasarkan penggunaan spesifiknya.
Token tambahan dari penggunaan alat berasal dari:
tools dalam permintaan API (nama alat, deskripsi, dan skema)tool_use dalam permintaan dan respons APItool_result dalam permintaan APIKetika Anda menggunakan tools, API juga secara otomatis menyertakan prompt sistem khusus untuk model yang mengaktifkan penggunaan alat. Jumlah token penggunaan alat yang diperlukan untuk setiap model tercantum dalam tabel berikut (tidak termasuk token tambahan yang disebutkan sebelumnya). Perhatikan bahwa tabel ini mengasumsikan setidaknya 1 alat disediakan. Jika tidak ada tools yang disediakan, maka pilihan alat none menggunakan 0 token prompt sistem tambahan.
| Model | Pilihan alat | Jumlah token prompt sistem penggunaan alat |
|---|---|---|
| Claude Opus 5 | auto, noneany, tool | 286 token 406 token |
| Claude Opus 4.8 | auto, noneany, tool | 290 token 410 token |
| Claude Opus 4.7 | auto, noneany, tool | 675 token 804 token |
| Claude Opus 4.6 | auto, noneany, tool | 497 token 589 token |
| Claude Opus 4.5 | auto, noneany, tool | 496 token 588 token |
| Claude Opus 4.1 (dihentikan, kecuali di Bedrock dan Google Cloud) | auto, noneany, tool | 313 token 315 token |
| Claude Opus 4 (dihentikan, kecuali di Google Cloud) | auto, noneany, tool | 313 token 315 token |
| Claude Sonnet 5 | auto, noneany, tool | 354 token 474 token |
| Claude Sonnet 4.6 | auto, noneany, tool | 497 token 589 token |
| Claude Sonnet 4.5 | auto, noneany, tool | 496 token 588 token |
| Claude Sonnet 4 (dihentikan, kecuali di Bedrock dan Google Cloud) | auto, noneany, tool | 313 token 315 token |
| Claude Haiku 4.5 | auto, noneany, tool | 496 token 588 token |
| Claude Haiku 3.5 (dihentikan, kecuali di Bedrock dan Google Cloud) | auto, noneany, tool | 264 token 355 token |
Jumlah token ini ditambahkan ke token input dan output normal Anda untuk menghitung total biaya permintaan.
Untuk harga per model saat ini, lihat bagian harga model.
Untuk informasi lebih lanjut tentang implementasi penggunaan alat dan praktik terbaik, lihat Penggunaan alat.
Definisi bash tool menambahkan token input berikut ke permintaan Anda. Ini merupakan tambahan dari prompt sistem penggunaan alat per-model yang berlaku setiap kali ada alat apa pun.
| Model | Token input tambahan |
|---|---|
| Claude Opus 5, Claude Opus 4.8, dan Claude Opus 4.7 | 325 token |
| Claude Opus 4.6, Claude Sonnet 4.6, dan versi sebelumnya | 244 token |
Token tambahan dikonsumsi oleh:
Lihat harga penggunaan alat untuk detail harga lengkap.
Eksekusi kode gratis saat digunakan dengan web search atau web fetch. Ketika web_search_20260209 (atau yang lebih baru) atau web_fetch_20260209 (atau yang lebih baru) disertakan dalam permintaan API Anda, tidak ada biaya tambahan untuk pemanggilan alat eksekusi kode di luar biaya token input dan output standar.
Saat digunakan tanpa alat-alat tersebut, eksekusi kode ditagih berdasarkan waktu eksekusi, yang dilacak secara terpisah dari penggunaan token:
Penggunaan eksekusi kode dilacak dalam respons:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}Alat editor teks menggunakan struktur harga yang sama dengan alat lain yang digunakan bersama Claude. Alat ini mengikuti harga token input dan output standar berdasarkan model Claude yang Anda gunakan.
Selain token dasar, token input tambahan berikut diperlukan untuk alat editor teks:
| Alat | Token input tambahan |
|---|---|
text_editor_20250429 (Claude 4.x) | 700 token |
Lihat harga penggunaan alat untuk detail harga lengkap.
Penggunaan pencarian web dikenakan biaya sebagai tambahan dari penggunaan token:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}Pencarian web tersedia di API Claude dengan harga $10 per 1.000 pencarian, ditambah biaya token standar untuk konten yang dihasilkan dari pencarian. Hasil pencarian web yang diambil sepanjang percakapan dihitung sebagai token input, baik dalam iterasi pencarian yang dijalankan selama satu giliran maupun dalam giliran percakapan berikutnya.
Setiap pencarian web dihitung sebagai satu penggunaan, terlepas dari jumlah hasil yang dikembalikan. Jika terjadi kesalahan selama pencarian web, pencarian web tersebut tidak akan ditagih.
Penggunaan web fetch tidak dikenakan biaya tambahan di luar biaya token standar:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}Alat web fetch tersedia di Claude API tanpa biaya tambahan. Anda hanya membayar biaya token standar untuk konten yang diambil dan menjadi bagian dari konteks percakapan Anda.
Untuk melindungi dari pengambilan konten berukuran besar secara tidak sengaja yang akan menghabiskan token secara berlebihan, gunakan parameter max_content_tokens untuk menetapkan batas yang sesuai berdasarkan kasus penggunaan dan pertimbangan anggaran Anda.
Contoh penggunaan token untuk konten umum:
Computer use mengikuti harga penggunaan alat standar. Saat menggunakan alat computer use:
Overhead prompt sistem: Beta computer use menambahkan 466–499 token ke prompt sistem
Penggunaan token alat computer use:
| Model | Token input per definisi alat |
|---|---|
| Model Claude 4.x | 735 token |
Konsumsi token tambahan:
Claude Managed Agents ditagih berdasarkan dua dimensi: token dan waktu berjalan sesi.
Semua token yang dikonsumsi oleh sesi Claude Managed Agents ditagih dengan tarif yang ditunjukkan di Harga model. Pengali caching prompt berlaku secara identik. Pencarian web yang dipicu di dalam sesi dikenakan biaya standar $10 per 1.000 pencarian. Di Claude Platform on AWS, biaya token sesi dan waktu berjalan dikonversi ke Claude Consumption Units dengan tarif standar. Harga premium mode cepat berlaku ketika model.speed agen diatur ke "fast".
Pengali residensi data juga berlaku: ketika model.inference_geo agen disematkan ke "us", token yang dikonsumsi oleh sesi yang menjalankan agen tersebut ditagih dengan tarif 1,1x dari tarif standar, pengali yang sama yang berlaku untuk inferensi khusus AS pada Messages API.
Pengubah Messages API berikut tidak berlaku untuk sesi Claude Managed Agents:
| Pengubah | Mengapa tidak berlaku |
|---|---|
| Diskon Batch API | Sesi bersifat stateful dan interaktif. Tidak ada mode batch. |
| Harga platform cloud | Tidak tersedia di platform cloud yang dioperasikan mitra. |
| SKU | Tarif | Pengukuran |
|---|---|---|
| Waktu berjalan sesi | $0,08 per jam-sesi | Durasi status running |
Waktu berjalan diukur hingga milidetik dan hanya terakumulasi saat status sesi adalah running. Waktu yang dihabiskan dalam status idle (menunggu pesan Anda berikutnya atau konfirmasi alat), rescheduling, atau terminated tidak dihitung dalam waktu berjalan.
Sesi coding satu jam menggunakan Claude Opus 5 yang mengonsumsi 50.000 token input dan 15.000 token output:
| Item baris | Perhitungan | Biaya |
|---|---|---|
| Token input | 50.000 × $5 / 1.000.000 | $0,25 |
| Token output | 15.000 × $25 / 1.000.000 | $0,375 |
| Waktu berjalan sesi | 1,0 jam × $0,08 | $0,08 |
| Total | $0,705 |
Jika caching prompt aktif dan 40.000 dari token input adalah pembacaan cache:
| Item baris | Perhitungan | Biaya |
|---|---|---|
| Token input tanpa cache | 10.000 × $5 / 1.000.000 | $0,05 |
| Token pembacaan cache | 40.000 × $5 × 0,1 / 1.000.000 | $0,02 |
| Token output | 15.000 × $25 / 1.000.000 | $0,375 |
| Waktu berjalan sesi | 1,0 jam × $0,08 | $0,08 |
| Total | $0,525 |
Untuk panduan terperinci tentang perhitungan ini, lihat panduan agen dukungan pelanggan.
Saat membangun agen dengan Claude:
"Rate limit" (batas laju) bervariasi berdasarkan tingkat penggunaan dan memengaruhi berapa banyak permintaan yang dapat Anda buat:
Untuk informasi batas laju terperinci, lihat Batas laju.
Untuk batas di luar tingkat Scale atau pengaturan harga khusus, hubungi tim penjualan.
Diskon volume mungkin tersedia untuk pengguna bervolume tinggi. Ini dinegosiasikan berdasarkan kasus per kasus.
Untuk pelanggan enterprise dengan kebutuhan spesifik:
Hubungi tim penjualan di [email protected] atau melalui Claude Console untuk mendiskusikan opsi harga enterprise.
Bagaimana penggunaan token dihitung?
Token adalah potongan teks yang diproses oleh model. Sebagai perkiraan kasar, 1 token kira-kira setara dengan 4 karakter atau 0,75 kata dalam bahasa Inggris. Jumlah pastinya bervariasi berdasarkan bahasa dan jenis konten.
Apakah ada tingkat gratis atau uji coba?
Pengguna baru menerima sejumlah kecil kredit gratis untuk menguji API. Hubungi penjualan untuk informasi tentang uji coba yang diperpanjang untuk evaluasi enterprise.
Bagaimana diskon digabungkan?
Diskon Batch API dan caching prompt dapat digabungkan. Misalnya, menggunakan kedua fitur bersama-sama memberikan penghematan biaya yang signifikan dibandingkan dengan panggilan API standar. Lihat harga caching prompt untuk mengetahui bagaimana pengali berinteraksi.
Metode pembayaran apa yang diterima?
Kartu kredit utama diterima untuk akun standar. Pelanggan enterprise dapat mengatur faktur dan metode pembayaran lainnya.
Untuk pertanyaan tambahan tentang harga, hubungi [email protected].
Was this page helpful?