Claude Platform Docs
Modelli e prezziModelli

Claude Sonnet 5.5Latest

The best combination of speed and intelligence

Try in playground
Context window
1Mtokens
Max output
128Ktokens
Input pricing
$2/ MTok
Output pricing
$10/ MTok

Panoramica

Claude Sonnet 5.5 offre la migliore combinazione di velocità e intelligenza. Cinque "breaking changes" (modifiche che causano incompatibilità) interessano il codice già in esecuzione su Claude Sonnet 5:

Un'altra modifica altera la forma della risposta senza far fallire alcuna richiesta: il testo tra le chiamate agli strumenti viene restituito in blocchi thinking. Un'applicazione che trasmette in streaming quel testo ai propri utenti resta silenziosa tra le chiamate agli strumenti finché non imposta un valore display che restituisce il testo, oppure non disattiva il ragionamento anticipato con between_tools.

Novità di Claude Sonnet 5.5

Come si confronta

ModelContextMax outputPrice / MTokLatencyThinkingDefault effortKnowledge cutoff
Claude Fable 5.11M128K$10 / $50SlowerAdaptive (always on)highJun 2026
Claude Opus 5.51M128K$4 / $20ModerateAdaptive (always on)mediumJun 2026
Claude Sonnet 5.5This model1M128K$2 / $10FastAdaptivehighJun 2026
Claude Haiku 4.5200K64K$1 / $5FastestExtended—Feb 2025

Specifiche

Model IDs

Claude API
Amazon Bedrock
Google Cloud
Microsoft Foundry
Claude Platform on AWS

Pricing

Input
$2 / MTok
Output
$10 / MTok
5m cache write
$2.50 / MTok
Cache read
$0.20 / MTok
Batch API
50% discount on input and output

Full price list

Capabilities

Max output
128K tokens
Thinking
Adaptive
Comparative latency
Fast
Input → output
Text and images → text
Reliable knowledge cutoff
Jun 2026
Training data cutoff
Jun 2026

Availability

Status
Active (latest)
Released
September 28, 2026
Retirement
Not sooner than September 28, 2027

Buono a sapersi

  • L'"adaptive thinking" (ragionamento adattivo) è attivo per impostazione predefinita. L'impostazione di ragionamento più bassa è between_tools, che disattiva l'"up-front thinking" (ragionamento iniziale). Funziona con un livello di "effort" (sforzo) high o inferiore. Consulta Novità di Claude Sonnet 5.5.
  • Impostare temperature, top_p o top_k su un valore diverso da quello predefinito restituisce un errore 400.
  • La lunghezza minima di un prompt memorizzabile nella cache è di 512 token. Consulta "Prompt caching" (cache dei prompt).
  • Sulla Message Batches API, Claude Sonnet 5.5 supporta fino a 300k token di output con l'header beta output-300k-2026-03-24.
  • Interroga limiti e capacità in modo programmatico con la Models API.

Risorse

Differenze comportamentali e schemi di prompting specifici di Claude Sonnet 5.5.

Il controllo per la profondità del ragionamento, la "latency" (latenza) e il costo. Scegli un livello per ogni carico di lavoro.

Come funziona il ragionamento adattivo, quali impostazioni di ragionamento accetta ciascun modello e come vengono preservati i blocchi di ragionamento.

Riferimento

Listino prezzi completo, inclusi gli sconti per i batch e le tariffe della cache dei prompt.

Come funzionano gli ID dei modelli, gli alias e gli snapshot fissati.

Stato del ciclo di vita e impegni di ritiro per ogni modello Claude.

Was this page helpful?