Claude Platform Docs
Modèles et tarifsModèles

Claude Sonnet 5.5Latest

The best combination of speed and intelligence

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$2/ MTok
Output pricing
$10/ MTok

Vue d'ensemble

Claude Sonnet 5.5 offre la meilleure combinaison de vitesse et d'intelligence. Cinq « breaking changes » (changements incompatibles) affectent le code qui s'exécute déjà sur Claude Sonnet 5 :

Un autre changement modifie la forme de la réponse sans faire échouer aucune requête : le texte entre les appels d'outils est renvoyé dans des blocs thinking. Une application qui transmet ce texte en « streaming » (diffusion en continu) à ses utilisateurs devient silencieuse entre les appels d'outils jusqu'à ce qu'elle définisse une valeur display qui renvoie le texte, ou qu'elle désactive la réflexion préalable avec between_tools.

Nouveautés de Claude Sonnet 5.5

Comparaison

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.5This model1M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtended—Feb 2025

Spécifications

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$2 / MTok
Output
$10 / MTok
5m cache write
$2.50 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fast
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 28, 2026
Retirement
Not sooner than September 28, 2027

Bon à savoir

  • L'« adaptive thinking » (réflexion adaptative) est activée par défaut. Le paramètre de réflexion le plus bas est between_tools, qui désactive la réflexion préalable. Il fonctionne avec un niveau d'effort high ou inférieur. Consultez Nouveautés de Claude Sonnet 5.5.
  • Définir temperature, top_p ou top_k sur une valeur autre que celle par défaut renvoie une erreur 400.
  • La longueur minimale d'un prompt pouvant être mis en cache est de 512 tokens. Consultez « Prompt caching » (mise en cache des prompts).
  • Sur la Message Batches API, Claude Sonnet 5.5 prend en charge jusqu'à 300k tokens de sortie avec le « beta header » (en-tête bêta) output-300k-2026-03-24.
  • Interrogez les limites et les capacités par programmation avec la Models API.

Ressources

Différences de comportement et modèles de prompts propres à Claude Sonnet 5.5.

Le contrôle de la profondeur de réflexion, de la « latency » (latence) et du coût. Choisissez un niveau par charge de travail.

Fonctionnement de la réflexion adaptative, paramètres de réflexion acceptés par chaque modèle et conservation des blocs de réflexion.

Référence

Liste complète des prix, y compris les remises sur les lots et les tarifs de mise en cache des prompts.

Fonctionnement des identifiants de modèle, des alias et des instantanés épinglés.

Statut du cycle de vie et engagements de retrait pour chaque modèle Claude.

Was this page helpful?