OpenAI presenta GPT-6 Sol e Luna: Metà Prezzo, Stessa Intelligenza di Frontiera
OpenAI amplia la famiglia GPT-6 con Sol e Luna, efficienti in termini di costi
OpenAI ha ufficialmente ampliato la sua linea GPT-6 con il rilascio di GPT-6 Sol e GPT-6 Luna, due nuovi modelli progettati per offrire intelligenza di frontiera a metà del costo dei loro predecessori. L'annuncio, fatto il 22 settembre 2026, segue il lancio precedente di GPT-6 Astra, che rimane il modello di punta dell'azienda per i compiti più impegnativi.
I nuovi modelli rappresentano un cambiamento strategico verso l'efficienza dei costi, mirando a sviluppatori e aziende che necessitano di capacità AI avanzate senza il prezzo premium. Sfruttando miglioramenti nella cache e nell'inferenza, OpenAI ha ridotto i prezzi API del 50% rispetto ai prezzi promozionali di GPT-5.6, rendendo questi modelli accessibili per applicazioni ad alto volume e quotidiane.
Ripartizione dei prezzi: un taglio del 50% su tutta la linea
Il cambiamento principale è la drastica riduzione dei prezzi. GPT-6 Sol ora costa $2 per milione di token di input e $10 per milione di token di output, in calo rispetto a $4 e $20 rispettivamente per GPT-5.6 Sol. GPT-6 Luna segue la stessa linea, con un prezzo di $0,10 per milione di token di input e $0,50 per milione di token di output, dimezzando le tariffe precedenti di $0,20 e $1,20.
Questi non sono prezzi promozionali ma le tariffe standard, ha confermato un portavoce di OpenAI a The New Stack. Le riduzioni sono rese possibili da una cache di prompt migliorata, che ora offre sconti del 90% sulle letture di token di input memorizzati nella cache, e da un'infrastruttura di inferenza più efficiente. GitHub ha già segnalato che questi miglioramenti hanno ridotto l'elaborazione di nuovi prompt di oltre il 50% su miliardi di richieste.
Benchmark delle prestazioni: qualità quasi Astra a una frazione del costo
OpenAI posiziona Sol e Luna come alternative capaci ad Astra per la maggior parte dei flussi di lavoro professionali. Su AutomationBench, GPT-6 Sol con impegno xhigh ha ottenuto un punteggio del 33,2%, superando Claude Opus 5 con impegno massimo (26,9%) e costando solo il 9% del prezzo di Opus 5 per attività. Anche con impegno basso, GPT-6 Astra ha ottenuto un punteggio del 30,3%, ma a un costo 3,9 volte superiore a quello di Sol.
Nella programmazione, i risultati di DeepSWE v1.1 mostrano GPT-6 Sol con impegno massimo che raggiunge il 68,8%, entro 1,1 punti dal punteggio più alto di Claude Fable 5 (69,9%), ma con un costo per attività inferiore dell'80%. Anche GPT-6 Luna ha impressionato, eguagliando Claude Opus 5 e Fable 5 con impegno medio, ma costando dal 93% al 96% in meno per attività.
Accuratezza fattuale e allineamento: meno errori, migliore collaborazione
OpenAI sottolinea miglioramenti significativi nell'affidabilità fattuale. Nelle valutazioni interne basate su conversazioni reali segnalate, GPT-6 Sol commette circa la metà degli errori del suo predecessore, avvicinandosi all'accuratezza di Astra. Anche GPT-6 Luna migliora sostanzialmente, eguagliando l'accuratezza di GPT-5.6 Sol a livelli di impegno più elevati, ma a circa un centesimo del costo.
I modelli ereditano anche lo stile di collaborazione raffinato di Astra, offrendo risposte più chiare e concise con meno gergo. In un confronto affiancato, GPT-6 Sol ha dimostrato un migliore giudizio non saltando a conclusioni e fornendo spiegazioni più trasparenti delle sue azioni, un notevole miglioramento per le conversazioni tecniche.
Miglioramenti della cache e strumenti per sviluppatori
Oltre ai prezzi, OpenAI ha migliorato la cache dei prompt per aiutare gli sviluppatori a risparmiare di più. Il nuovo Dashboard per la cache dei prompt e lo strumento di diagnostica consentono agli sviluppatori di monitorare i tassi di hit della cache e identificare opportunità di ottimizzazione. Inoltre, gli sviluppatori possono ora regolare lo sforzo di ragionamento e la disponibilità degli strumenti senza rompere la cache, preservando il contesto per il riutilizzo.
Questi miglioramenti sono particolarmente preziosi per i flussi di lavoro agentici, dove conversazioni lunghe e contesto ripetuto sono comuni. La combinazione di prezzi dei token più bassi e una migliore cache potrebbe ridurre i costi totali di oltre il 50% per molte applicazioni, rendendo i modelli GPT-6 praticabili per attività precedentemente considerate troppo costose.
Disponibilità e integrazione nell'ecosistema
GPT-6 Sol e Luna sono ora disponibili in ChatGPT Work e Codex per tutti gli utenti Plus, Pro, Business, Enterprise e Edu. Gli utenti Free e Go possono accedere a GPT-6 Luna nell'app desktop. Nell'API OpenAI, sono accessibili come gpt-6-sol e gpt-6-luna.
GitHub Copilot ha anche integrato i nuovi modelli, con GPT-6 Sol disponibile per i piani Pro+, Max, Business e Enterprise, mentre GPT-6 Luna è accessibile in tutti i livelli di Copilot. Questa ampia disponibilità segnala l'impegno di OpenAI a integrare i suoi modelli nei flussi di lavoro quotidiani degli sviluppatori.
Il panorama competitivo e perché è importante
I prezzi aggressivi di OpenAI sfidano direttamente i modelli Claude di Anthropic, che hanno gareggiato in termini di prestazioni e costi. Dimezzando i prezzi e mantenendo prestazioni quasi di punta, OpenAI sta chiaramente puntando al mercato di massa delle applicazioni AI, dall'automazione agli assistenti di programmazione.
Il lancio affronta anche le crescenti preoccupazioni sui costi e la sostenibilità dell'AI. Poiché gli agenti di programmazione e i flussi di lavoro automatizzati consumano più token, il costo totale di proprietà diventa critico. GPT-6 Sol e Luna offrono una soluzione pragmatica per i team che necessitano di affidabilità senza il premium di Astra.
Mentre Astra rimane la scelta migliore per i progetti più impegnativi, Sol e Luna rappresentano la democratizzazione dell'intelligenza di frontiera. Per gli sviluppatori, ciò significa più spazio per iterare, progetti più ambiziosi e, in definitiva, più valore dagli investimenti in AI.
Related News

GPT-6 Astra di OpenAI decifra il messaggio Enigma del 1941 che aveva sconfitto gli esperti per 20 anni

Gzip può essere un modello linguistico? Un'analisi approfondita della generazione di testo basata sulla compressione

Kev: Clone Open-Source di Jev Porta i Modelli Decisionali sul Tuo Hardware

Mini-AGI: L'apprendimento continuo su 8 GB di VRAM è ora possibile

La Spagna blocca Archive.today e i suoi mirror senza ordine del tribunale

