Physical Address
304 North Cardinal St.
Dorchester Center, MA 02124
Physical Address
304 North Cardinal St.
Dorchester Center, MA 02124

OpenAI ha annunciato un taglio dell’80% sul modello GPT-5.6 Luna e del 20% su GPT-5.6 Terra, con effetto immediato dal 30 luglio 2026. Luna ora costa appena 0,20 dollari per milione di token in input, rendendo economicamente sostenibili carichi di lavoro su larga scala che finora obbligavano le aziende a scegliere tra qualità e budget. L’operazione si inserisce in un mercato dove la pressione sui prezzi è in aumento: l’analisi di The Decoder evidenzia la concorrenza dei provider cinesi low-cost e la stessa Microsoft che promuove i propri modelli MAI come alternative più economiche a OpenAI.
A partire dal 30 luglio 2026, GPT-5.6 Luna costa 0,20 $ per milione di token in input e 1,20 $ per milione di token in output, con una riduzione dell’80%. GPT-5.6 Terra scende del 20%, portandosi a 2 $ in input e 12 $ in output. Il listino di GPT-5.6 Sol resta invariato, ma debutta la modalità Fast nell’API: offre velocità fino a 2,5 volte superiori rispetto all’elaborazione Standard, al doppio del prezzo, senza alcuna perdita di qualità.
| Modello | Prezzo input (per 1M token) | Prezzo output (per 1M token) | Riduzione |
|---|---|---|---|
| GPT-5.6 Luna | $0,20 | $1,20 | –80% |
| GPT-5.6 Terra | $2,00 | $12,00 | –20% |
| GPT-5.6 Sol | invariato | invariato | – (Fast mode: 2× prezzo per 2,5× velocità) |
I nuovi prezzi non nascono da un semplice rincorrersi al ribasso. OpenAI spiega che GPT-5.6 Sol ha ottimizzato in autonomia l’infrastruttura: ha riscritto kernel di produzione, riducendo del 20% il costo end-to-end di serving, e ha migliorato l’efficienza nella generazione dei token di oltre il 15% tramite speculative decoding. I risparmi così generati vengono ora trasferiti ai clienti, creando un circolo virtuoso in cui ogni generazione di modelli rende più economica quella successiva.

I partner di OpenAI confermano l’impatto concreto. Michele Catasta, Presidente e Head of AI di Replit, definisce Luna «quanto di più vicino abbiamo mai avuto a un’intelligenza troppo economica per essere misurata». Hoda Noorian, AI Product di Notion, riporta che Terra ha offerto qualità comparabile a GPT-5.5 «alla metà del costo per task e con il 60% di tempo in meno». Sid Pardeshi, CTO di Blitzy, sottolinea il salto nel comportamento agentico: grazie a Luna il riutilizzo della cache dei prompt è passato dal 24% al 90%, gestendo 2,2× più contesto con 8,5× meno token in output e un costo inferiore dell’87% rispetto a GPT-5.4 mini.
Secondo The Decoder, l’iniziativa di OpenAI va letta anche come reazione alla concorrenza aggressiva dei fornitori cinesi e alla recente strategia di Microsoft, che promuove apertamente i propri modelli MAI come alternative più economiche. Una guerra dei prezzi che, avverte la testata, potrebbe rallentare la crescita dei ricavi dei laboratori di frontiera, i cui bilanci dipendono da massicci investimenti in infrastrutture. Il taglio dell’80% su Luna è la risposta più diretta: portare il costo di un task che un anno fa valeva un dollaro a circa 6 centesimi, con una velocità 9 volte superiore.
Mettendo in prospettiva i numeri, GPT-5.6 Luna costa il 99% in meno per task rispetto a Fable 5 nel lavoro professionale, secondo i dati OpenAI. Per le imprese significa che interi flussi di lavoro — dalla classificazione documentale all’automazione di routine — diventano economicamente praticabili su scala prima impensabile. Stanislas Polu, CTO di Dust, riassume: «Abbiamo visto un miglioramento operativo significativo: a parità di compiti agentici, Luna è 40% più veloce e 40% più economica del modello precedente, offrendo un equilibrio eccellente tra qualità, velocità ed efficienza». Il taglio dei prezzi di GPT-5.6 segna un punto di svolta in cui l’intelligenza artificiale avanzata diventa una commodity accessibile, mentre la sostenibilità finanziaria di chi sviluppa modelli di frontiera resta una partita aperta in un mercato sempre più competitivo.