Physical Address
304 North Cardinal St.
Dorchester Center, MA 02124
Physical Address
304 North Cardinal St.
Dorchester Center, MA 02124

Anthropic ha rilasciato oggi Claude Sonnet 5, un modello che promette capacità agentiche da fascia alta a un costo inferiore rispetto ai concorrenti diretti. La mossa arriva in un momento in cui ogni grande laboratorio sta ridefinendo i propri modelli come piattaforme per agenti autonomi, ma con Sonnet 5 il differenziatore diventa il costo operativo: 2 dollari per milione di token in input fino al 31 agosto 2026, poi 3 dollari da settembre. Meno di Opus 4.8, di GPT-5.5 e di Gemini 3.1 Pro.
Il messaggio è chiaro: la capacità agentica non è più un vantaggio competitivo, ma il nuovo standard. La partita adesso si gioca su quanto costa far girare un agente affidabile senza supervisione umana.
Sonnet 5 parte con una tariffa promozionale di 2 dollari per milione di token in input e 10 dollari per milione di token in output, valida fino al 31 agosto 2026. Dal 1° settembre 2026 il costo in input salirà a 3 dollari per milione di token, mentre l'output resterà a 10 dollari.
Il modello diventa da subito l'opzione predefinita per i piani Free e Pro di Claude, ed è disponibile per tutti gli altri livelli di abbonamento.
Rispetto ai competitor diretti:
| Modello | Prezzo input (per milione token) | Prezzo output (per milione token) |
|---|---|---|
| Claude Sonnet 5 (fino ad agosto 2026) | 2 USD | 10 USD |
| Claude Sonnet 5 (da settembre 2026) | 3 USD | 10 USD |
| Claude Opus 4.8 | Più alto di Sonnet 5* | Più alto di Sonnet 5* |
| GPT-5.5 | Più alto di Sonnet 5* | Più alto di Sonnet 5* |
| Gemini 3.1 Pro | Più alto di Sonnet 5* | Più alto di Sonnet 5* |
*Anthropic dichiara che Sonnet 5 è più economico di tutti e tre, senza specificare le cifre esatte dei rivali. Gemini 3.5 Flash, il modello leggero di Google lanciato a maggio 2026, resta comunque più economico di Sonnet 5.
Non è solo una questione di listino. La scommessa di Anthropic è che gli sviluppatori possano ottenere prestazioni vicine a quelle di Opus 4.8 — il modello di punta dell'azienda, rilasciato il 28 maggio 2026 — spendendo molto meno.
Sul fronte delle capacità agentiche, Sonnet 5 segna un salto rispetto al predecessore Sonnet 4.6 (febbraio 2026). Su un benchmark di coding agentico, il nuovo modello ottiene il 63,2%, contro il 58,1% di Sonnet 4.6. Opus 4.8 resta avanti con il 69,2%, ma il gap si è ridotto.
Ancora più interessante il test sul lavoro di conoscenza, dove Sonnet 5 supera leggermente lo stesso Opus 4.8 — un risultato che Anthropic stessa definisce inaspettato, visto che Opus 4.8 eccelle nei problemi più complessi come ricerche approfondite e decisioni che richiedono giudizio sfumato.

Tra i tester citati da Anthropic, Daniel Shepard, senior engineer di Zapier, racconta un caso concreto: «Abbiamo affidato a Claude Sonnet 5 un lavoro in due parti — aggiornare i livelli account su Salesforce e inviare un annuncio di lancio ai contatti enterprise — e l'ha completato dall'inizio alla fine. Prima si bloccava a metà. Per l'automazione quotidiana, non c'è partita».
Il modello, secondo quanto riportato da Anthropic, verifica automaticamente il proprio output senza che gli venga richiesto esplicitamente, e porta a termine task complessi dove le versioni precedenti si fermavano.
Sonnet 5 mostra tassi più bassi di «comportamenti indesiderati» rispetto a Sonnet 4.6, tra cui cooperazione con usi malevoli, inganni e attacchi di prompt injection. Allucina meno ed è meno incline a comportamenti adulatori (sycophancy).
Non raggiunge però il livello di Opus 4.8 e di Claude Mythos Preview sul fronte dell'allineamento. Anzi, ZDNET fa notare una contraddizione: Sonnet 5 ha mostrato un tasso più alto di comportamenti disallineati proprio rispetto a Mythos Preview — il modello di punta di Anthropic che a inizio giugno 2026 era stato al centro di un acceso dibattito sulla sicurezza.
Su un punto Anthropic è netta: «Le valutazioni mostrano che ha un'abilità molto inferiore nell'eseguire compiti pericolosi di cybersecurity rispetto ai nostri attuali modelli Opus». Una precisazione che arriva dopo le turbolenze seguite al lancio — e al rapido ritiro — dei modelli Fable 5 e Mythos 5 all'inizio di giugno 2026.
Fabian Hedin, co-fondatore di Lovable, sintetizza così: «Stiamo mettendo strumenti potenti nelle mani di milioni di costruttori. Un modello che sa quando dire di no è importante quanto uno che sa come costruire».
Il lancio di Sonnet 5 conferma un pattern che attraversa tutte le fonti: tra maggio e giugno 2026, OpenAI, Google e Anthropic hanno tutti presentato i loro modelli come «i più agentici di sempre». GPT-5.6 Sol, Gemini 3.5 Flash, Opus 4.8 e ora Sonnet 5 condividono la stessa narrativa. La capacità di pianificare, usare tool e operare in autonomia è diventata la nuova baseline, non un extra.
Il differenziatore si è spostato su due assi: costo e affidabilità senza supervisione. Su entrambi, Sonnet 5 cerca di posizionarsi come l'opzione pragmatica per sviluppatori e aziende — offrendo prestazioni da modello di punta a una frazione del prezzo, con l'aggiunta di controlli di sicurezza automatici.
Resta da vedere se il mercato premierà questa strategia. I concorrenti hanno già risposto: Gemini 3.5 Flash, più economico di Sonnet 5, sta già operando come motore predefinito dell'AI Mode di Google Search, con un'integrazione che nessun altro laboratorio può eguagliare per scala. La guerra dei prezzi è appena iniziata.