GPT-6.1 Sol: OpenAI porta un’intelligenza quasi da Astra a un quinto del prezzo
GPT-6.1 Sol avvicina le prestazioni di GPT-6 Astra in coding, uso del computer e documenti, a un quinto del prezzo e con la cache a 0,10 dollari.

OpenAI ha presentato GPT-6.1 Sol, l’aggiornamento del modello intermedio della famiglia GPT-6 annunciato durante il DevDay 2026 di San Francisco. La promessa è semplice da riassumere e ambiziosa da mantenere: offrire un’intelligenza molto vicina a quella di GPT-6 Astra, il modello di punta, a un quinto del suo prezzo standard per token in ingresso e in uscita. È una mossa che parla soprattutto a sviluppatori e aziende, cioè a chi paga le API a consumo e costruisce agenti che lavorano per ore su codice, documenti e applicazioni.
Il tempismo non è casuale. GPT-6 Sol era arrivato appena una settimana prima insieme a Luna, e nel frattempo il rilascio di GPT-6.1 Astra è stato fermato perché il modello non aveva superato i controlli di sicurezza interni. In questo scenario, il vero aggiornamento della settimana arriva dalla fascia di mezzo.
Cosa cambia con GPT-6.1 Sol
Secondo l’annuncio ufficiale di OpenAI, GPT-6.1 Sol migliora in modo sostanziale rispetto a GPT-6 Sol su quattro fronti: programmazione agentica, uso del computer, lavoro professionale sui documenti e ricerca scientifica. L’idea di fondo è ridurre la distanza con Astra proprio nei compiti che oggi generano più consumo di token, cioè quelli in cui un agente deve ragionare, chiamare strumenti e ripetere più passaggi prima di arrivare a un risultato.
Non si tratta quindi di un nuovo modello di punta, ma di un modello pensato per diventare quello “di tutti i giorni” in produzione.
I prezzi: il vero punto della notizia
Il listino è l’elemento che rende l’annuncio rilevante. Nelle API GPT-6.1 Sol costa 2 dollari per milione di token in ingresso e 10 dollari per milione di token in uscita. Per confronto, GPT-6 Astra costa 10 dollari in ingresso e 50 in uscita, mentre GPT-6 Luna, il modello più leggero, si ferma a 0,10 e 0,50 dollari.
La novità più interessante per chi costruisce agenti riguarda però l’input in cache: 0,10 dollari per milione di token, il 95% in meno rispetto al prezzo standard in ingresso e la metà rispetto al prezzo in cache di GPT-6 Sol. Quando un agente rilegge lo stesso contesto a ogni richiesta, per esempio un repository di codice, un manuale aziendale o una lunga conversazione, è proprio la cache a determinare il costo reale. Abbassarla così tanto significa rendere economicamente sostenibili flussi di lavoro che fino a ieri avevano senso solo su piccola scala.
In pratica, a parità di budget puoi far lavorare un agente molto più a lungo.
Le prestazioni dichiarate nei benchmark
OpenAI accompagna il lancio con una serie di test, e vale la pena leggerli con attenzione, ricordando che sono dati forniti dall’azienda stessa e che il confronto con i concorrenti si basa sui report pubblici di questi ultimi.
Programmazione e uso del computer
Su DeepSWE v1.1, benchmark che misura la capacità di risolvere compiti di ingegneria del software lunghi e complessi in codebase reali, GPT-6.1 Sol raggiunge lo stesso livello di GPT-6 Astra a circa un quinto del costo. Rispetto al miglior punteggio di GPT-6 Sol, il salto è di 6,4 punti percentuali, ottenuto per giunta con un livello di ragionamento più basso e quindi con meno spesa.
Nell’uso del computer il progresso è simile. Su OSWorld 2.0, che valuta agenti impegnati in flussi di lavoro lunghi tra applicazioni reali, il nuovo modello supera GPT-6 Sol di sette punti percentuali al massimo sforzo di ragionamento, spendendo meno della metà. Rispetto ad Astra resta a 2,1 punti di distanza, ma con un costo per compito pari a circa un settimo.
Per chi sviluppa agenti che cliccano, compilano e navigano, è un compromesso molto interessante.
Documenti e automazione aziendale
Sul fronte professionale OpenAI cita due test. Il primo è GDP.pdf, che misura la precisione nel rispondere a domande su PDF complessi pieni di tabelle, grafici e note a margine, presi da ambiti come finanza, sanità e diritto. Qui GPT-6.1 Sol ottiene un punteggio superiore a Claude Opus 5.5 di Anthropic spendendo meno della metà per compito, e si avvicina ad Astra con un costo di circa un quinto.
Il secondo è AutomationBench, che verifica se un agente porta a termine correttamente flussi di lavoro aziendali in più passaggi usando decine di strumenti tra vendite, marketing, operations, assistenza, finanza e risorse umane. GPT-6.1 Sol supera Opus 5.5 di 2,2 punti a sforzo di ragionamento medio, con un costo di circa un terzo, e guadagna 4,8 punti rispetto a GPT-6 Sol nella stessa configurazione.
Ricerca scientifica e accuratezza
Il dato più sorprendente riguarda Terminal-Bench Science 0.1, dedicato a flussi di lavoro scientifici come analisi dei dati, simulazioni e dimostrazione di teoremi. Il nuovo Sol più che raddoppia il punteggio del predecessore e costa in media 5,47 dollari per compito, contro i 23,21 dollari di Opus 5.5 e i 23,80 di Astra. OpenAI riconosce comunque che Astra resta il modello migliore in questo test, con il 68,1%, e che va preferito per i problemi scientifici più difficili.
Migliora anche l’accuratezza fattuale. Su un insieme di conversazioni volutamente difficili, in cui gli utenti avevano segnalato un errore di un modello precedente, la quota di risposte con almeno un errore scende dall’11,4% al 7,7% a basso sforzo di ragionamento, una riduzione di circa il 32%.
Meno errori a parità di costo: è esattamente ciò che serve a chi mette un modello davanti ai clienti.
Sicurezza: il confronto con lo stop di Astra
Il lancio arriva pochi giorni dopo che OpenAI ha deciso di fermare GPT-6.1 Astra perché non superava i test di sicurezza. Per questo il capitolo dedicato all’allineamento di GPT-6.1 Sol assume un peso particolare.
Secondo la scheda tecnica pubblicata insieme al modello, GPT-6.1 Sol è più trasparente sui propri limiti e più affidabile nel rispettare le istruzioni e i vincoli di sicurezza rispetto a GPT-6 Sol. Un esempio concreto: in un test progettato per verificare se l’agente avvisa l’utente quando lo strumento di ricerca è guasto, invece di tirare a indovinare, GPT-6.1 Sol omette la segnalazione nel 2,1% dei casi, contro il 4,9% di GPT-6 Sol e l’1,5% di Astra. OpenAI dichiara inoltre di non aver osservato alcun tentativo di aggirare il revisore automatico di sicurezza.
Sono numeri misurati in scenari costruiti apposta per provocare errori, quindi non rappresentano l’uso quotidiano. Indicano però una direzione chiara: OpenAI vuole mostrare che velocità di rilascio e controlli possono convivere.
Dove e quando puoi usarlo
GPT-6.1 Sol è disponibile da subito per gli utenti Plus, Pro, Business, Enterprise ed Edu dentro ChatGPT Work e Codex, mentre non è ancora arrivato nella chat classica. Gli sviluppatori possono richiamarlo tramite le API con l’identificativo gpt-6.1-sol. Nei prossimi giorni arriverà anche la versione Ultrafast, il nuovo livello di velocità premium presentato al DevDay, che in Codex promette una generazione dei token fino a otto volte più rapida.
Se usi già ChatGPT in ambito professionale, il cambiamento più visibile lo noterai quindi in Codex e negli strumenti di lavoro, non nella conversazione di tutti i giorni.
Perché conta per sviluppatori e aziende
La strategia di OpenAI con la famiglia GPT-6 è ormai leggibile. Astra resta il riferimento per le massime prestazioni, Luna copre i volumi enormi a costo minimo, e Sol diventa il cavallo da lavoro per gli agenti. Con GPT-6.1 Sol il divario tra il modello intermedio e quello di punta si riduce al punto che, per molti casi d’uso, pagare cinque volte di più per Astra diventa difficile da giustificare.
È un cambio che si somma alle altre novità del DevDay, a partire dagli agenti sempre attivi dots, che hanno bisogno proprio di modelli capaci ma sostenibili per restare accesi a lungo. Ed è anche una risposta diretta alla concorrenza: il confronto esplicito con Opus 5.5 su documenti, automazione e ricerca scientifica mostra che la partita tra i grandi laboratori oggi si gioca sul rapporto tra qualità e costo per compito, più che sul primato assoluto nei benchmark.
Resta da capire quanto questi risultati si confermeranno fuori dai test di laboratorio.
Chi ha seguito il lancio di GPT-6 Sol e Luna con i prezzi dimezzati sa che OpenAI sta spingendo con decisione sulla riduzione dei costi, e la cache a 0,10 dollari è il segnale più forte in questa direzione. Per le aziende che hanno già in produzione agenti basati su GPT-6 Sol, il passaggio alla versione 6.1 sembra quasi obbligato: prestazioni migliori, meno errori e un contesto riutilizzato che costa la metà.
Conclusioni
GPT-6.1 Sol non è il modello più potente di OpenAI, ma potrebbe diventare il più usato. Porta un’intelligenza vicina ad Astra nei compiti che contano per il lavoro reale, dalla programmazione ai documenti complessi, con un prezzo che cambia i conti di chi costruisce agenti. Il consiglio è di provarlo sui tuoi flussi più costosi, confrontando qualità e spesa con il modello che usi oggi, invece di fidarti solo dei benchmark dichiarati.
Stai già usando GPT-6 Sol o Astra nei tuoi progetti? Continua a seguirci per i test sul campo e per tutte le novità del DevDay 2026, e raccontaci se il nuovo Sol cambia davvero i tuoi costi.