Claude Platform Docs

Scegliere il modello giusto

Scegliere un modello Claude significa bilanciare capacità, velocità e costo. Questa guida illustra le domande da porsi, due modi per scegliere un modello di partenza e come testare la scelta.

Stabilisci i criteri chiave

Quando scegli un modello Claude, valuta innanzitutto questi fattori:

  • Capacità: Quali funzionalità o capacità specifiche deve avere il modello per soddisfare le tue esigenze?
  • Velocità: Quanto rapidamente deve rispondere il modello nella tua applicazione? Claude Opus 5.5, Claude Opus 5, e Claude Opus 4.8 supportano la fast mode (modalità veloce, in anteprima di ricerca), che offre una velocità di output fino a 2,5 volte superiore a un prezzo premium.
  • Costo: Qual è il tuo budget sia per lo sviluppo sia per l'utilizzo in produzione?
  • Effort: Diversi modelli Claude supportano un parametro effort (impegno) che bilancia l'intelligenza con la "latency" (latenza) e il costo all'interno di un singolo modello. Regolare l'effort è spesso una leva migliore rispetto al cambio di modello. Su Claude Fable 5.1 e Claude Opus 5, inizia con il valore predefinito (high) e regolalo verso l'alto o verso il basso in base alle tue valutazioni. Su Claude Opus 5.5 il valore predefinito è medium; inizia da lì e regolalo allo stesso modo. Su Claude Opus 4.8 e Claude Opus 4.7, il livello di effort xhigh, compreso tra high e max, è l'impostazione migliore per la maggior parte dei casi d'uso di coding e agentici.

Scegli il modello migliore con cui iniziare

Esistono due approcci generali che puoi utilizzare per iniziare a testare quale modello Claude funziona meglio per le tue esigenze.

Opzione 1: Inizia privilegiando l'efficienza

Per molte applicazioni, iniziare con un modello più veloce e più conveniente come Claude Haiku 4.5 può essere l'approccio ottimale:

  1. Inizia l'implementazione con Claude Haiku 4.5.
  2. Testa a fondo il tuo caso d'uso.
  3. Valuta se le prestazioni soddisfano i tuoi requisiti.
  4. Passa a un modello superiore solo se necessario per specifiche lacune di capacità.

Questo approccio consente un'iterazione rapida, costi di sviluppo inferiori ed è spesso sufficiente per molte applicazioni comuni. Questo approccio è ideale per:

  • Prototipazione e sviluppo iniziali
  • Applicazioni con requisiti di latenza stringenti
  • Implementazioni sensibili ai costi
  • Attività semplici ad alto volume

Opzione 2: Inizia privilegiando le capacità

Per attività complesse in cui l'intelligenza e le capacità avanzate sono fondamentali, potresti voler iniziare privilegiando le capacità: implementa con il punto di partenza più potente per la tua attività, quindi ottimizza verso modelli più efficienti in seguito:

  1. Implementa con Claude Opus 5.5.
  2. Ottimizza i tuoi prompt per questo modello.
  3. Valuta se le prestazioni soddisfano i tuoi requisiti.
  4. Valuta di aumentare l'efficienza abbassando l'effort o passando a modelli inferiori nel tempo, con una maggiore ottimizzazione del flusso di lavoro.
  5. Se le tue valutazioni con effort xhigh o max risultano ancora insufficienti per ragionamenti impegnativi o lavoro agentico a lungo orizzonte, passa a Claude Fable 5.1.

Questo approccio è ideale per:

  • Attività di ragionamento complesso
  • Applicazioni scientifiche o matematiche
  • Attività che richiedono una comprensione sfumata
  • Applicazioni in cui l'accuratezza prevale sulle considerazioni di costo
  • Coding avanzato e lavoro agentico ad alta autonomia

Claude Opus 5.5 (claude-opus-5-5) è progettato per il coding agentico e il lavoro intellettuale di lunga durata, con l'adaptive thinking (ragionamento adattivo) sempre attivo. Se la tua integrazione forza l'uso degli strumenti (tool_choice di tipo any o tool), disattiva il thinking o utilizza lo strumento computer use computer_20251124, consulta Modifiche che causano incompatibilità prima di effettuare il passaggio.

Claude Fable 5.1 (claude-fable-5-1) è il modello più capace di Anthropic aperto a tutti i clienti. Estende Claude Fable 5 con capacità più solide di coding agentico di lunga durata, lavoro intellettuale e ricerca, agli stessi prezzi di input e output, con le letture dalla cache a un quarto del costo. Claude Mythos 5.1 (claude-mythos-5-1) offre le stesse capacità esclusivamente ai partecipanti a Project Glasswing. Entrambi i modelli utilizzano il ragionamento adattivo sempre attivo. Consulta Novità di Claude Fable 5.1 per i dettagli.

Per le "context windows" (finestre di contesto), i limiti di output e i prezzi, consulta la tabella di confronto dei modelli.

Matrice di selezione del modello

La maggior parte dei carichi di lavoro inizia con Claude Opus 5.5.

Quando hai bisogno di...Valuta di iniziare con...Esempi di casi d'uso
La massima capacità disponibileClaude Fable 5.1Sessioni di agenti che durano ore, ricerca approfondita in più fasi, analisi portate fino a un documento, un foglio di calcolo o una presentazione completi
Programmazione agentica complessa e lavoro aziendaleClaude Opus 5.5Agenti di programmazione autonomi che operano per più ore, refactoring su larga scala, ingegneria di sistemi complessi, flussi di lavoro con uso intensivo della visione, computer use
Velocità e capacità per carichi di lavoro quotidiani di programmazione, agenti e aziendaliClaude Sonnet 5.5Generazione di codice, analisi dei dati, creazione di contenuti, comprensione visiva, uso agentico degli strumenti
La latenza e il prezzo più bassi, con ragionamento estesoClaude Haiku 4.5Applicazioni in tempo reale, elaborazione intelligente ad alto volume, implementazioni attente ai costi che richiedono un ragionamento solido, attività di sub-agenti

Decidi se passare a un modello superiore o cambiare modello

Per determinare se hai bisogno di passare a un modello superiore o cambiare modello, dovresti:

  1. Creare test di benchmark specifici per il tuo caso d'uso: disporre di un buon set di valutazione è il passaggio più importante del processo.
  2. Testare con i tuoi prompt e dati reali.
  3. Confrontare le prestazioni tra i modelli per:
    • Accuratezza delle risposte
    • Qualità delle risposte
    • Gestione dei casi limite
  4. Valutare i compromessi tra prestazioni e costo.

Combina i modelli

Le strategie multi-modello abbinano un modello a costo inferiore a un modello di frontiera in modo che la maggior parte dei token venga fatturata alla tariffa più bassa. I due schemi comuni sono un esecutore che inoltra le decisioni difficili a un consulente e un orchestratore che delega il lavoro di massa a worker a costo inferiore. Consulta Ottimizzare costo e intelligenza per entrambe le strategie, esempi misurati e opzioni di implementazione.

Prossimi passi

Consulta le specifiche dettagliate e i prezzi dei modelli Claude più recenti

Progettato per ragionamenti impegnativi e lavoro agentico a lungo termine

Il modello Opus più recente: modifiche incompatibili, nuove funzionalità e differenze di comportamento

Il modello Sonnet più recente: modifiche incompatibili, nuove funzionalità e differenze di comportamento

Nuove funzionalità e modifiche di comportamento in Claude Sonnet 5

Inizia con la tua prima chiamata API

Was this page helpful?