Claude Sonnet 5.5Latest
The best combination of speed and intelligence
- Context window
- 1Mtokens
- Max output
- 128Ktokens
- Input pricing
- $2/ MTok
- Output pricing
- $10/ MTok
Panoramica
Claude Sonnet 5.5 offre la migliore combinazione di velocità e intelligenza. Cinque "breaking changes" (modifiche che causano incompatibilità) interessano il codice già in esecuzione su Claude Sonnet 5:
- Disattiva l'"up-front thinking" (ragionamento anticipato) con
between_tools. - Il "forced tool use" (uso forzato degli strumenti) restituisce un errore.
- I "thinking blocks" (blocchi di ragionamento) sono legati al modello e alla conversazione.
- Sull'API Claude e su Google Cloud, il precedente strumento di "computer use" (uso del computer)
computer_20251124non è accettato. - L'"advisor tool" (strumento advisor) rifiuta Claude Opus 4.8, Claude Opus 4.7 e Claude Sonnet 5 come advisor.
Un'altra modifica altera la forma della risposta senza far fallire alcuna richiesta: il testo tra le chiamate agli strumenti viene restituito in blocchi thinking. Un'applicazione che trasmette in streaming quel testo ai propri utenti resta silenziosa tra le chiamate agli strumenti finché non imposta un valore display che restituisce il testo, oppure non disattiva il ragionamento anticipato con between_tools.
Come si confronta
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Claude Fable 5.1 | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Claude Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Claude Sonnet 5.5This model | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jun 2026 |
| Claude Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
Specifiche
Model IDs
Pricing
- Input
- $2 / MTok
- Output
- $10 / MTok
- 5m cache write
- $2.50 / MTok
- 1h cache write
- $4 / MTok
- Cache read
- $0.20 / MTok
- Batch API
- 50% discount on input and output
Capabilities
- Context window
- 1M tokens
- Max output
- 128K tokens
- Max output (Batch API, beta)
- 300K tokens
- Thinking
- Adaptive
- Default effort
high- Comparative latency
- Fast
- Input → output
- Text and images → text
- Reliable knowledge cutoff
- Jun 2026
- Training data cutoff
- Jun 2026
Availability
- Status
- Active (latest)
- Released
- September 28, 2026
- Retirement
- Not sooner than September 28, 2027
- Platforms
- Claude APIAmazon BedrockGoogle CloudMicrosoft FoundryClaude Platform on AWS
Buono a sapersi
- L'"adaptive thinking" (ragionamento adattivo) è attivo per impostazione predefinita. L'impostazione di ragionamento più bassa è
between_tools, che disattiva l'"up-front thinking" (ragionamento iniziale). Funziona con un livello di "effort" (sforzo)higho inferiore. Consulta Novità di Claude Sonnet 5.5. - Impostare
temperature,top_potop_ksu un valore diverso da quello predefinito restituisce un errore 400. - La lunghezza minima di un prompt memorizzabile nella cache è di 512 token. Consulta "Prompt caching" (cache dei prompt).
- Sulla Message Batches API, Claude Sonnet 5.5 supporta fino a 300k token di output con l'header beta
output-300k-2026-03-24. - Interroga limiti e capacità in modo programmatico con la Models API.
Risorse
Differenze comportamentali e schemi di prompting specifici di Claude Sonnet 5.5.
Il controllo per la profondità del ragionamento, la "latency" (latenza) e il costo. Scegli un livello per ogni carico di lavoro.
Come funziona il ragionamento adattivo, quali impostazioni di ragionamento accetta ciascun modello e come vengono preservati i blocchi di ragionamento.
Riferimento
Listino prezzi completo, inclusi gli sconti per i batch e le tariffe della cache dei prompt.
Come funzionano gli ID dei modelli, gli alias e gli snapshot fissati.
Stato del ciclo di vita e impegni di ritiro per ogni modello Claude.
Was this page helpful?