OpenAI ha presentato GPT-6.1 Sol durante il suo developer day, posizionandolo come il modello con il miglior rapporto prezzo-prestazioni a parità di livello. Il punto chiave è semplice: prestazioni vicine a GPT-6 Astra, ma con un costo nettamente più basso, fino a un quinto nei prezzi standard di input e output token.
Il nuovo modello si inserisce nella fascia alta delle soluzioni orientate a coding, uso del computer e flussi di lavoro professionali. Oltre alla spinta sull’efficienza economica, OpenAI sottolinea miglioramenti anche sul fronte dell’affidabilità, con meno errori fattuali e una maggiore aderenza ai vincoli e alle intenzioni dell’utente.
GPT-6.1 Sol punta tutto su costo ridotto e prestazioni vicine al top di gamma
GPT-6 Astra resta il modello di riferimento della gamma OpenAI per i compiti complessi e i workflow professionali a più passaggi, ma GPT-6.1 Sol nasce per offrire una resa molto simile con una struttura di costo più accessibile. OpenAI lo descrive come la proposta più conveniente nella sua classe, e i numeri pubblicati vanno nella stessa direzione.
Per la gestione in cache, il prezzo dichiarato è di 0,1 dollari per milione di token per GPT-6.1 Sol, pari a circa 0,09 euro al cambio attuale, con un taglio del 50% rispetto a GPT-6 Sol. Nei task di programmazione per agenti, nelle operazioni al computer e nei flussi professionali, il modello si avvicina alle prestazioni di Astra pur mantenendo un profilo di spesa molto più leggero.
Sul fronte della disponibilità, GPT-6.1 Sol è accessibile dal 29 settembre agli utenti ChatGPT Work e agli utenti Codex dei piani Plus, Pro, Business, Enterprise ed Edu. Per gli sviluppatori è già richiamabile via API con l’identificativo gpt-6.1-sol.
Nei benchmark il nuovo modello migliora su coding, automazione e uso del computer
Nei test software engineering DeepSWE v1.1, GPT-6.1 Sol raggiunge risultati comparabili a GPT-6 Astra quando il livello di ragionamento è elevato. In condizioni di costo e ragionamento più contenuti, ottiene invece un vantaggio di 6,4 punti percentuali rispetto a GPT-6 Sol, segnale interessante per chi deve bilanciare budget e qualità operativa.
Anche nei documenti professionali e nei task complessi il modello si difende bene, con risultati migliori di Opus 5.5 a meno della metà del costo per attività. In AutomationBench, con intensità di ragionamento media, supera Opus 5.5 di 2,2 punti percentuali e lavora a circa un terzo del costo.
Uno dei dati più concreti arriva da OSWorld 2.0 offline: alla massima intensità di ragionamento, GPT-6.1 Sol ottiene 7 punti in più di GPT-6 Sol con un costo inferiore alla metà. Rispetto ad Astra il distacco si limita a 2,1 punti, ma il costo per singolo task scende a circa un settimo.
Affidabilità e allineamento migliorano insieme alla convenienza
OpenAI segnala progressi anche nella qualità delle risposte. Con bassa intensità di ragionamento, il tasso di errori fattuali scende dall’11,4% di GPT-6 Sol al 7,7%, con una riduzione di circa il 32%. È un dato importante perché indica un miglioramento non solo nei punteggi di benchmark, ma anche nella tenuta operativa del modello.
Il margine rispetto ad Astra resta contenuto: in tutte le configurazioni di ragionamento, la differenza nel tasso di errore rimane entro 1,9 punti percentuali. Viene inoltre evidenziata una maggiore disciplina nel seguire limiti espliciti, nel gestire strumenti di ricerca non disponibili e nel ridurre operazioni non autorizzate.





