GPT-5.6 Luna costa l'80% in meno, Terra il 20%: OpenAI taglia i prezzi API

OpenAI ha annunciato ieri un taglio netto dei prezzi API per due dei tre modelli della famiglia GPT-5.6. La mossa arriva a tre settimane dalla GA del 9 luglio e, secondo l'azienda, riflette i guadagni di efficienza ottenuti anche grazie al fatto che GPT-5.6 Sol è stato usato per ottimizzare i propri kernel di serving.
I nuovi prezzi (per 1M token, dal 30 luglio)
- Luna: $0,20 input / $1,20 output (era $1 / $6) → -80%
- Terra: $2 input / $12 output (era $2,50 / $15) → -20%
- Sol: $5 input / $30 output → invariato Il taglio si riflette anche su ChatGPT Work e Codex: le subscription non cambiano prezzo, ma l'uso di Terra e Luna consuma meno crediti. Su AWS il rollout dei nuovi listini parte in giornata.
Cosa cambia in pratica
Luna a $0,20/M input è il modello più economico della famiglia, e OpenAI lo posiziona come opzione per lavoro ad alto volume: classificazione documenti, interazioni customer, implementazione di modifiche ben specificate. Secondo i dati pubblicati, su Agents' Last Exam Luna supera Fable 5 con un costo per task stimato inferiore di circa il 99%, a velocità quasi 9 volte superiore. Il pattern consigliato è quello del routing: Sol per pianificare e gestire l'incertezza, Luna per eseguire i passi operativi e scrivere test. Un workflow di coding, ad esempio, può usare Sol per definire il piano e Luna per implementare.
Fast mode per Sol
Novità anche per Sol: il Fast mode sostituisce il Priority Processing e offre fino a 2,5x la velocità dello Standard a 2x il prezzo, senza cambiamenti nell'intelligenza. Le richieste API già taggate priority continuano a funzionare e vengono instradate automaticamente su Fast mode. In Codex corrisponde al comando /fast.
Disponibilità
Terra e Luna restano disponibili su ChatGPT Work, Codex e API. Gli utenti Free e Go accedono a Terra; Plus, Pro, Business ed Enterprise possono scegliere sia Terra sia Luna.
Dove il quadro è meno lineare
- I benchmark citati (Agents' Last Exam, Artificial Analysis Intelligence Index v4.1) sono riportati da OpenAI nella propria pagina. Non equivalgono a una verifica indipendente.
- Il taglio dell'80% su Luna è impressionante, ma Luna resta il modello con i punteggi più bassi della famiglia su Terminal-Bench 2.1 (84,7% contro l'88,8% di Sol). Il trade-off costo/capacità va valutato sul proprio caso d'uso.
- "Meno crediti" su ChatGPT Work e Codex è utile, ma OpenAI non ha pubblicato una tabella di conversione aggiornata. Chi dipende dai budget mensili dovrebbe verificare il consumo effettivo dopo il rollout. Michele Catasta (President & Head of AI di Replit) ha commentato: "GPT-5.6 Luna is the closest we've come to intelligence too cheap to meter. I've never seen a model this affordable be this powerful." Voi cambiate qualcosa nel vostro stack dopo questo taglio? Luna a questi prezzi diventa l'opzione default per i task ripetitivi, oppure Terra resta il punto di equilibrio?
Fonti
- Advancing the price-performance frontier with GPT-5.6 - OpenAI, 30 luglio 2026
- GPT-5.6: Frontier intelligence that scales with your ambition - OpenAI, 9 luglio 2026 (pricing originale GA)
📌 Questo articolo riassume una discussione su r/vibecodingitalia. Leggi il post originale.

Scritto da
Michael Gasperini@TheStreamCode
Founder & Sviluppatore
Founder di Vibe Coding Italia, la community italiana sull'intelligenza artificiale. Progetta e sviluppa prodotti con l'AI e ne racconta l'applicazione pratica attraverso guide e articoli.

