Ultimo aggiornamento: 25 luglio 2026
Anthropic ha ora due modelli Claude solidi nella fascia medio-premium: Claude Opus 5 (rilasciato il 24 luglio 2026) e Claude Sonnet 5 (rilasciato il 30 giugno 2026). Entrambi condividono la stessa finestra di contesto da 1M di token e un output massimo di 128K. Entrambi supportano il pensiero adattivo. Entrambi sono disponibili in Claude Code, nell’API e in tutti i piani Claude. La domanda non è più “quale è migliore” — è “quale è migliore per il tuo carico di lavoro”.
Risposta rapida: Opus 5 ($5/$25 per MTok) è il modello premium — SOTA su Frontier-Bench, 3x il secondo migliore su ARC-AGI 3 e a meno dello 0.5% da Fable 5 su CursorBench a metà del costo. Sonnet 5 ($3/$15, lancio $2/$10 fino al 31 agosto) gestisce programmazione quotidiana, ricerca e lavoro professionale a un prezzo più basso. Opus 5 ha un cutoff delle conoscenze di maggio 2026; quello di Sonnet 5 è di gennaio 2026. Inizia con Sonnet 5 per il lavoro sensibile ai costi; usa Opus 5 quando l’accuratezza su compiti complessi a più passaggi giustifica il sovrapprezzo.
| Confronto | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| Data di rilascio | 24 luglio 2026 | 30 giugno 2026 |
| Prezzo base | $5 / $25 per MTok | $3 / $15 per MTok (lancio: $2 / $10 fino al 31 agosto) |
| Finestra di contesto | 1M di token | 1M di token |
| Output massimo | 128K token | 128K token |
| Cutoff delle conoscenze | Maggio 2026 | Gennaio 2026 |
| Frontier-Bench v0.1 | SOTA (2x+ Opus 4.8) | Non riportato |
| SWE-bench Verified | Non riportato singolarmente | 85.2% |
| SWE-bench Pro | Non riportato singolarmente | 63.2% |
| ARC-AGI 3 | 3x il secondo miglior modello | Non riportato |
| Terminal-Bench 2.1 | Non riportato singolarmente | 80.4% |
| BrowseComp | Non riportato singolarmente | 84.7% |
| Conservazione dei dati | Conservazione zero dei dati supportata | Conservazione zero dei dati supportata |
| Predefinito nell’app Claude | Max (predefinito); Pro (il più potente) | Free e Pro (predefinito) |
| Modalità veloce | Sì (~2.5x la velocità a 2x il prezzo) | Non disponibile |
| Ideale per | Programmazione complessa, agenti, enterprise, scienza | Programmazione quotidiana, ricerca, produzione ad alto volume |
Verified 25 luglio 2026
- Gamma di modelli e specifiche: Panoramica dei modelli Anthropic
- Pagina prodotto di Opus: Claude Opus
- Prezzi: Prezzi dell’API Claude
- Lancio di Opus 5: Introducing Claude Opus 5
- Lancio di Sonnet 5: Introducing Claude Sonnet 5
- Sicurezza di Sonnet 5: System Card di Claude Sonnet 5
L’accesso ai modelli, i prezzi e la composizione dei piani possono cambiare. Verifica i dettagli aggiornati prima di prendere decisioni di produzione.
Che cosa è ciascun modello
Claude Opus 5 è il più recente modello di classe Opus di Anthropic — il livello premium per tutti i giorni. Offre un’intelligenza vicina a Fable 5 a metà prezzo, con il cutoff delle conoscenze più recente di qualsiasi modello Claude (maggio 2026). Su Frontier-Bench v0.1 più che raddoppia il punteggio di Opus 4.8 e supera tutti gli altri modelli. Su CursorBench 3.2 si posiziona a meno dello 0.5% dal massimo di Fable 5. È il modello predefinito su Claude Max e il modello più potente su Claude Pro.
Claude Sonnet 5 è il più recente modello di classe Sonnet di Anthropic — il livello “cavallo da lavoro”. Rilasciato il 30 giugno 2026, è progettato per il lavoro agentico: programmazione, uso di strumenti, automazione del browser, ricerca e completamento di attività professionali. È il modello predefinito su Claude Free e Pro, e il suo prezzo di lancio ($2/$10 per MTok fino al 31 agosto) lo rende il punto di ingresso più conveniente nella generazione Claude 5.
Il posizionamento è lineare: Sonnet 5 è il modello che provi per primo; Opus 5 è il modello a cui passi quando l’accuratezza su compiti difficili giustifica il sovrapprezzo.
Confronto dei benchmark
I dati dei benchmark di questi due modelli provengono da fonti diverse — i materiali di lancio di Opus 5 di Anthropic enfatizzano Frontier-Bench, ARC-AGI 3 e OSWorld 2.0, mentre la System Card di Sonnet 5 riporta SWE-bench, Terminal-Bench e BrowseComp. Dove entrambi i modelli riportano lo stesso benchmark, il confronto è diretto. Dove non accade, tratta i dati come indicativi.
Programmazione e ingegneria del software
| Benchmark | Claude Opus 5 | Claude Sonnet 5 | Claude Fable 5 | Claude Opus 4.8 | Che cosa misura |
|---|---|---|---|---|---|
| Frontier-Bench v0.1 | SOTA (2x+ Opus 4.8) | — | — | Baseline | Attività di ingegneria del software di valore |
| CursorBench 3.2 (sforzo massimo) | A meno dello 0.5% da Fable 5 | — | Massimo | — | Programmazione reale in Cursor |
| SWE-bench Verified | — | 85.2% | 95.0% | — | Risoluzione di issue reali di GitHub |
| SWE-bench Pro | — | 63.2% | 80.3% | 69.2% | Ingegneria del software a lungo orizzonte |
| SWE-bench Multilingual | — | 78.3% | — | — | Attività software in 9 linguaggi |
| Terminal-Bench 2.1 | — | 80.4% | 88.0% | 82.7% | Attività da terminale e riga di comando |
| FrontierCode v1 | — | 38.8% | — | — | Programmazione agentica su PR reali |
Tre osservazioni:
- I benchmark di punta di Opus 5 sono diversi da quelli di Sonnet 5. Il lancio di Opus 5 enfatizza Frontier-Bench (dove è SOTA) e CursorBench (dove quasi eguaglia Fable 5). La System Card di Sonnet 5 riporta SWE-bench e Terminal-Bench. La mancanza di benchmark sovrapposti rende impreciso un confronto diretto sulla programmazione.
- Dove Sonnet 5 riporta punteggi, sono solidi ma inferiori a Fable 5 e Opus 4.8 nei test più difficili. Il 63.2% di Sonnet 5 su SWE-bench Pro è dietro il 69.2% di Opus 4.8 e l'80.3% di Fable 5. Opus 5 non riporta SWE-bench Pro singolarmente, ma i suoi risultati su Frontier-Bench e CursorBench suggeriscono che sia al livello di Opus 4.8 o sopra.
- Entrambi sono importanti passi avanti rispetto ai predecessori. Opus 5 più che raddoppia Opus 4.8 su Frontier-Bench. Sonnet 5 più che raddoppia Sonnet 4.6 su FrontierCode (38.8% vs 15.1%).
Ragionamento, agenti e lavoro di conoscenza
| Benchmark | Claude Opus 5 | Claude Sonnet 5 | Che cosa misura |
|---|---|---|---|
| ARC-AGI 3 | 3x il secondo miglior modello | Non riportato | Risoluzione di problemi inediti |
| GDPval-AA v2 | SOTA | 1609 Elo | Lavoro di conoscenza professionale |
| Zapier AutomationBench | ~1.5x il secondo migliore (100% superato) | 13.5% | Automazione di attività aziendali |
| OSWorld 2.0 | Supera Fable 5 a 1/3 del costo | 81.2% (OSWorld-Verified) | Attività di uso del computer |
| BrowseComp | Non riportato | 84.7% (agente singolo) | Ricerca web e reperimento di informazioni |
| HLE (senza strumenti) | Migliore della categoria | 43.2% | Conoscenze esperte |
| HLE (con strumenti) | Migliore della categoria | 57.4% | Conoscenze esperte con strumenti |
| DeepSearchQA | Migliore della categoria | Non riportato | Ricerca approfondita |
Opus 5 domina nei benchmark incentrati sul ragionamento e agentici. Sonnet 5 si difende bene nelle attività assistite da strumenti (BrowseComp, HLE con strumenti) e nell’uso del computer (81.2% su OSWorld-Verified), ma il divario si allarga sul ragionamento inedito (ARC-AGI 3) e sul lavoro di conoscenza professionale (GDPval-AA).
Scienza e domini specializzati
Opus 5 supera Opus 4.8 in ogni valutazione di scienze della vita, inclusi +10.2 punti in chimica organica e +7.7 punti nella predizione della funzione delle proteine. È ora il modello generalmente disponibile più capace di Anthropic per la ricerca scientifica, poiché le salvaguardie sulla biologia di Fable 5 sono più restrittive. La System Card di Sonnet 5 non enfatizza i benchmark scientifici.
Tratta i benchmark pubblicati dai fornitori come indicativi. Convalida sul tuo carico di lavoro prima di impegnare il budget.
Confronto dei prezzi
Entrambi i modelli usano prezzi per milione di token. Sonnet 5 ha un prezzo di lancio temporaneo fino al 31 agosto 2026.
| Componente di prezzo | Claude Opus 5 | Claude Sonnet 5 | Lancio Sonnet 5 (fino al 31 agosto) |
|---|---|---|---|
| Input base | $5 / MTok | $3 / MTok | $2 / MTok |
| Output base | $25 / MTok | $15 / MTok | $10 / MTok |
| Scrittura cache da 5 minuti | $6.25 / MTok | $3.75 / MTok | $2.50 / MTok |
| Scrittura cache da 1 ora | $10 / MTok | $6 / MTok | $4 / MTok |
| Hit e aggiornamenti della cache | $0.50 / MTok | $0.30 / MTok | $0.20 / MTok |
| Input Batch API | $2.50 / MTok | $1.50 / MTok | $1 / MTok |
| Output Batch API | $12.50 / MTok | $7.50 / MTok | $5 / MTok |
| Input in modalità veloce | $10 / MTok | — | — |
| Output in modalità veloce | $50 / MTok | — | — |
Il rapporto di prezzo è di circa 1.67x al prezzo standard ($5/$3 in input, $25/$15 in output) e di 2.5x durante il periodo di lancio di Sonnet 5 ($5/$2 in input, $25/$10 in output).
Strategia dei costi:
- Durante il prezzo di lancio (fino al 31 agosto): Sonnet 5 è eccezionalmente competitivo. Per il lavoro ad alto volume in cui una qualità vicina a Opus è sufficiente, è il predefinito ovvio.
- Dopo il 31 agosto: il rapporto di 1.67x significa che Opus 5 costa circa il 67% in più per token. Se Opus 5 completa le attività in meno turni e con meno tentativi, il divario di costo effettivo si riduce.
- Il caching dei prompt riduce i costi per entrambi i modelli fino al 90% sul contesto ripetuto. Gli hit della cache costano $0.50/MTok su Opus 5 e $0.30/MTok su Sonnet 5.
- La modalità veloce è solo di Opus 5 — circa 2.5x la velocità a 2x il prezzo base ($10/$50 per MTok). Sonnet 5 non ha una modalità veloce.
Avvertenza sul tokenizer: Sonnet 5 usa un tokenizer aggiornato. Lo stesso input può diventare circa da 1.0x a 1.35x più token rispetto a Sonnet 4.6, a seconda del tipo di contenuto. Misura prompt reali invece di stimare da vecchi conteggi di token.
Confronto delle funzionalità
| Funzionalità | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| Finestra di contesto | 1M di token | 1M di token |
| Output massimo | 128K token (300K via Batch API) | 128K token |
| Cutoff delle conoscenze | Maggio 2026 | Gennaio 2026 |
| Pensiero | Adattivo (sforzo configurabile) | Adattivo (sforzo configurabile) |
| Sforzo predefinito | high su API e Claude Code | Configurabile |
| Conservazione dei dati | Conservazione zero dei dati supportata | Conservazione zero dei dati supportata |
| Modalità veloce | Sì (~2.5x la velocità a 2x il prezzo) | No |
| Inferenza solo negli USA | Disponibile a 1.1x il prezzo | Verifica la disponibilità attuale |
| Salvaguardie cyber | ~85% di interventi del classificatore in meno rispetto a Fable 5 | Attive per impostazione predefinita; meno capace nel cyber pericoloso rispetto a Opus/Mythos |
| Salvaguardie sulla biologia | Meno restrittive; miglior modello GA per la scienza | Salvaguardie standard |
| Allineamento | Il modello Claude più allineato; il comportamento ingannevole più basso | Più sicuro di Sonnet 4.6; più comportamenti disallineati di Opus/Mythos in alcune valutazioni |
| Claude Free | Non disponibile | Modello predefinito |
| Claude Pro | Il modello più potente su Pro | Modello predefinito |
| Claude Max | Modello predefinito | Disponibile |
| Claude Team / Enterprise | Disponibile | Disponibile |
| Claude Code | Disponibile | Disponibile |
| ID del modello API | claude-opus-5 | claude-sonnet-5 |
Il divario di quattro mesi nel cutoff delle conoscenze conta più di quanto sembri. Se il tuo lavoro coinvolge librerie, API, normative o eventi recenti da febbraio a maggio 2026, Opus 5 ha conoscenze affidabili che Sonnet 5 non ha.
Quando usare Opus 5 vs Sonnet 5
| Domanda | Inizia con | Motivo |
|---|---|---|
| Il compito è programmazione complessa a più passaggi o lavoro agentico? | Opus 5 | SOTA su Frontier-Bench; vicino a Fable 5 su CursorBench |
| È programmazione quotidiana, ricerca o lavoro professionale? | Sonnet 5 | Prestazioni solide a costo inferiore |
| Ti servono le conoscenze più fresche (successive a gennaio 2026)? | Opus 5 | Cutoff di maggio 2026 vs gennaio 2026 |
| Il lavoro è ad alto volume e sensibile ai costi? | Sonnet 5 | 1.67x più economico al prezzo standard; 2.5x durante il lancio |
| Stai costruendo agenti IA di produzione? | Opus 5 (predefinito) o Sonnet 5 (sensibile ai costi) | Prova entrambi; Opus 5 ha un’autoverifica più forte |
| È ricerca scientifica? | Opus 5 | Miglior modello GA per la scienza; meno restrizioni sulla biologia |
| Ti serve la conservazione zero dei dati? | Entrambi vanno bene | Entrambi supportano la ZDR; Fable 5 no |
| Il lavoro è vicino alla cybersecurity? | Opus 5 | 85% di interventi del classificatore in meno rispetto a Fable 5; più forte di Sonnet 5 |
| Sei su Claude Free? | Sonnet 5 | Opus 5 non è disponibile su Free |
| Ti serve la modalità veloce per lavoro sensibile alla latenza? | Opus 5 | La modalità veloce è solo di Opus 5 |
| Il fallimento è costoso e la revisione umana è limitata? | Opus 5 | Giudizio, autoverifica e capacità di obiettare più forti |
| Stai facendo prototipi o esperimenti? | Sonnet 5 (prezzo di lancio) | $2/$10 per MTok fino al 31 agosto è molto competitivo |
La metrica migliore è il costo per attività riuscita, non il prezzo per token. I guadagni di efficienza di Opus 5 — meno tentativi, meno token, meno latenza — fanno sì che nella pratica possa costare meno di un modello dal prezzo inferiore che richiede più iterazioni.
Analisi per caso d’uso
Programmazione
Vincitore: Opus 5 per il lavoro complesso; Sonnet 5 per le attività quotidiane.
Opus 5 è SOTA su Frontier-Bench v0.1 e a meno dello 0.5% da Fable 5 su CursorBench 3.2. I clienti riferiscono che individua i propri errori, verifica il proprio lavoro in un browser alle larghezze desktop e mobile, e gestisce migrazioni multi-file che i modelli Opus precedenti non riuscivano a fare. Usa meno token ai livelli di sforzo più alti — un cliente riferisce 1/7 dei token di ragionamento e metà della latenza di Opus 4.8.
Sonnet 5 ottiene 85.2% su SWE-bench Verified e 80.4% su Terminal-Bench 2.1 — risultati solidi per la programmazione quotidiana. Gestisce bene correzioni di bug, generazione di test, refactoring e triage della CI. Ma nei compiti a lungo orizzonte più difficili (SWE-bench Pro: 63.2%) resta dietro a Opus 4.8 (69.2%) e Fable 5 (80.3%).
Impostazione pratica: usa Sonnet 5 come predefinito in Claude Code. Passa a Opus 5 per il debugging complesso, i refactoring multi-repo e i compiti in cui Sonnet 5 fallisce o richiede più tentativi. Vedi I migliori agenti IA per programmare nel 2026 per il quadro più ampio.
Agenti
Vincitore: Opus 5 per gli agenti di produzione; Sonnet 5 per gli agenti sensibili ai costi.
I benchmark agentici di Opus 5 sono dominanti: 3x il secondo migliore su ARC-AGI 3, ~1.5x il secondo migliore su Zapier AutomationBench (con un tasso di superamento del 100%) e supera Fable 5 su OSWorld 2.0 a un terzo del costo. Il suo comportamento di autoverifica — controllare le ipotesi, incrociare i risultati con metodi indipendenti — lo rende più affidabile per flussi di lavoro lunghi e a più passaggi.
Sonnet 5 è progettato per il lavoro agentico e migliora in modo significativo rispetto a Sonnet 4.6 nell’uso di strumenti, nell’automazione del browser e nelle attività di flussi di lavoro aziendali. Il suo 84.7% su BrowseComp e il 57.4% su HLE con strumenti mostrano un solido ragionamento assistito da strumenti. Ma nelle valutazioni interne di Anthropic mostra ancora tassi più alti di alcuni comportamenti disallineati rispetto ai modelli Opus.
Impostazione pratica: usa Sonnet 5 come primo passaggio. Se il compito fallisce o la fiducia è bassa, instrada verso Opus 5. Un umano rivede gli output ad alto rischio prima del deployment.
Scrittura e creazione di contenuti
Vincitore: Sonnet 5 per la maggior parte della scrittura; Opus 5 per la profondità analitica.
Per redigere, editare e produrre contenuti, Sonnet 5 offre il valore migliore. Gestisce post di blog, documentazione, riassunti e scrittura creativa a un costo inferiore. Opus 5 brilla nella scrittura analitica di lungo formato, nella documentazione tecnica che richiede ragionamento profondo e nei contenuti in cui conta l’accuratezza su temi recenti (il suo cutoff di maggio 2026 aiuta qui).
Ricerca
Vincitore: dipende dal tipo di ricerca.
L'84.7% di Sonnet 5 su BrowseComp e il 57.4% su HLE con strumenti lo rendono forte per la ricerca sul web, la scoperta di fonti e la sintesi multi-fonte. Opus 5 guida su DeepSearchQA e su HLE senza strumenti, e il suo cutoff delle conoscenze di maggio 2026 significa che ha conoscenze affidabili sugli sviluppi recenti che a Sonnet 5 mancano.
Per la ricerca scientifica in particolare, Opus 5 è la scelta chiara — è il modello generalmente disponibile più capace di Anthropic per la scienza, con meno restrizioni sulla biologia rispetto a Fable 5.
Enterprise
Vincitore: Opus 5 per la maggior parte dei carichi di lavoro enterprise.
Entrambi i modelli supportano la conservazione zero dei dati, che è il requisito enterprise chiave. Ma Opus 5 aggiunge un allineamento più forte (il comportamento ingannevole più basso di qualsiasi modello Claude recente), un’autoverifica migliore, un cutoff delle conoscenze più fresco e la modalità veloce per applicazioni sensibili alla latenza. Sonnet 5 è la scelta giusta per le pipeline enterprise ad alto volume in cui domina il costo per token e la complessità dei compiti è moderata.
Il fronte della concorrenza
Sia Opus 5 che Sonnet 5 competono con la famiglia GPT-5.6 di OpenAI. Il posizionamento:
| Modello Claude | Equivalente OpenAI | Equivalente Google |
|---|---|---|
| Claude Fable 5 (classe Mythos) | GPT-5.6 Sol | Gemini 3.1 Pro (livello inferiore) |
| Claude Opus 5 | GPT-5.6 Sol / Terra | Gemini 3.1 Pro |
| Claude Sonnet 5 | GPT-5.6 Terra | Gemini 3.1 Flash |
| Claude Haiku 4.5 | GPT-5.6 Luna | Gemini 3.1 Flash Lite |
Il rapporto prezzo-prestazioni di Opus 5 è la vera notizia. A $5/$25 per MTok, eguaglia o si avvicina a GPT-5.6 Sol ($5/$30 per MTok) sulla maggior parte dei benchmark, includendo il contesto completo da 1M di token alla tariffa standard. GPT-5.6 Sol applica un sovrapprezzo di 2x sull’input sopra i 272K token — il contesto da 1M di Opus 5 non ha alcun sovrapprezzo simile.
Sonnet 5 a $3/$15 per MTok (lancio $2/$10) batte sul prezzo GPT-5.6 Terra eguagliandolo o superandolo nei benchmark di programmazione e agentici. Durante il periodo di lancio, Sonnet 5 è uno dei modelli di classe frontier più convenienti disponibili.
Per il confronto dettagliato al livello frontier, vedi GPT-5.6 Sol vs Claude Fable 5.
FAQ
Claude Opus 5 vs Sonnet 5: qual è la differenza?
Opus 5 vale la pena rispetto a Sonnet 5?
Quale modello Claude è il migliore per programmare nel 2026?
Sonnet 5 vs Opus 5: come si confrontano i benchmark?
Opus 5 vs Sonnet 5: qual è la differenza di prezzo?
Sonnet 5 può fare quello che fa Opus 5?
Opus 5 vs Sonnet 5 per gli agenti IA: quale è meglio?
Dovrei passare da Sonnet 5 a Opus 5?
Entrambi i modelli supportano la conservazione zero dei dati?
Qual è la differenza di cutoff delle conoscenze tra Opus 5 e Sonnet 5?
Quale modello Claude è disponibile sul piano Free?
Come si confrontano Opus 5 e Sonnet 5 con GPT-5.6?
In sintesi
Claude Opus 5 e Claude Sonnet 5 non sono concorrenti — sono complementari. Sonnet 5 è il cavallo da lavoro predefinito: programmazione, ricerca e lavoro professionale solidi al costo più basso della generazione Claude 5. Opus 5 è l’escalation premium: intelligenza vicina a Fable 5 a metà prezzo, con le conoscenze più fresche, il ragionamento più forte e il miglior allineamento di qualsiasi modello Claude.
Inizia con Sonnet 5. Provalo sul tuo carico di lavoro reale. Se completa le attività in modo affidabile, stai ottenendo un valore eccellente — soprattutto durante il prezzo di lancio fino al 31 agosto. Passa a Opus 5 quando l’accuratezza su compiti complessi giustifica il sovrapprezzo, quando ti servono conoscenze successive a gennaio 2026 o quando il tuo lavoro tocca la scienza, la compliance enterprise o flussi di lavoro agentici ad alto rischio.
Per le analisi complete modello per modello, vedi la guida a Claude Opus 5 e la guida a Claude Sonnet 5. Per il confronto della generazione precedente, vedi Fable 5 vs Opus 4.8.