I nuovi prezzi di GPT-5.6 segnano un cambio di passo per chi lavora con l’intelligenza artificiale ogni giorno. OpenAI ha deciso di tagliare in maniera decisa il costo di due modelli della famiglia, Luna e Terra, e allo stesso tempo ha portato una nuova modalità Fast su Sol pensata per chi ha bisogno di risposte rapide. Il ragionamento dietro a tutto questo è semplice, dare più qualità a parità di spesa, così le aziende possono usare l’IA su un numero più ampio di attività senza gonfiare il budget.
Luna crolla del 80 per cento, Terra scende del 20
La parte che salta subito all’occhio è la revisione dei listini. GPT-5.6 Luna, che già era il modello più veloce ed economico della gamma, ora costa l’80 per cento in meno rispetto a prima. Anche GPT-5.6 Terra, pensato per bilanciare prestazioni, qualità e costi nelle attività di tutti i giorni, guadagna uno sconto, più contenuto ma comunque interessante, pari al 20 per cento.
Il bello è che il taglio non riguarda solo le API. Si vede anche nel consumo di crediti dentro gli abbonamenti a pagamento di ChatGPT Work e Codex. In pratica chi usa Terra e Luna manterrà gli stessi piani e gli stessi budget, ma ogni richiesta brucerà meno crediti di prima. Secondo OpenAI questa revisione rende finalmente sostenibili tanti scenari che fino a ieri erano troppo costosi, come l’analisi di grandi quantità di documenti, la classificazione automatica delle richieste dei clienti o l’esecuzione di flussi di lavoro complessi su larga scala.
Efficienza senza perdere in intelligenza
L’azienda tiene a sottolineare un punto che spesso viene dimenticato. Scegliere un modello non vuol dire per forza puntare al più potente in circolazione, perché ogni attività chiede un equilibrio diverso tra velocità, precisione, affidabilità e costi. In questo senso Luna viene descritto come capace di offrire prestazioni paragonabili a quelle dei modelli di fascia alta di circa un anno fa, ma a una frazione del prezzo e con una velocità nettamente superiore. OpenAI cita anche alcuni benchmark interni secondo cui, in certi test professionali, Luna batte modelli concorrenti tenendo un costo per attività molto più basso.
Da qui l’idea di costruire flussi di lavoro misti. Un’azienda potrebbe affidare a Sol le fasi di pianificazione e ragionamento più complicate, lasciando poi a Luna l’implementazione del codice, la scrittura dei test, l’esecuzione delle verifiche e tutte quelle operazioni ripetitive ma comunque di buon livello.
La modalità Fast e i modelli che migliorano sé stessi
Oltre ai prezzi arriva anche una novità dedicata a chi lavora con le API. La vecchia elaborazione prioritaria lascia il posto alla modalità Fast, disponibile per Sol, che stando all’azienda garantisce velocità fino a 2,5 volte superiori rispetto all’elaborazione standard, mantenendo inalterato il livello di intelligenza del modello. Il costo è il doppio della modalità Standard, ma diventa una scelta sensata in tutti quei casi in cui il tempo di risposta pesa davvero. E la transizione sarà indolore, tutte le richieste che usavano il vecchio sistema prioritario finiranno in automatico nella nuova modalità Fast, senza toccare una riga di codice.
C’è poi un dettaglio curioso. GPT-5.6 Sol viene già usato internamente per ottimizzare l’infrastruttura di OpenAI. Dentro un processo seguito dagli ingegneri, il modello ha riscritto e ottimizzato kernel di produzione, progettato ed eseguito centinaia di esperimenti per migliorare la generazione dei token e monitorato le fasi di addestramento, intervenendo quando serviva. Queste ottimizzazioni hanno già portato a una riduzione del 20 per cento dei costi complessivi del modello, mentre l’efficienza nella generazione dei token è cresciuta di oltre il 15 per cento.
Disponibilità
Terra e Luna restano accessibili tramite ChatGPT Work, Codex e API OpenAI. Per quanto riguarda ChatGPT Work e Codex, gli utenti Free e Go possono usare Terra, mentre gli abbonati Plus, Pro, Business ed Enterprise scelgono tra Terra e Luna. I nuovi prezzi delle API parlano chiaro, per Terra si va a circa 1,80 euro per milione di token di input e circa 11 euro per milione di token di output. Luna scende invece a circa 0,18 euro per milione di token di input e circa 1,10 euro per milione di token di output, confermandosi il modello più conveniente della famiglia. I prezzi di Sol non cambiano, mentre le nuove tariffe per Terra e Luna vengono distribuite un po’ alla volta anche sull’infrastruttura AWS.










