GPT-6.1 Sol costa come Claude Sonnet 5.5: chi vince dipende da quanto li fai ragionare

Martedì 29 settembre 2026 OpenAI, l’azienda che fa ChatGPT, ha rilasciato GPT-6.1 Sol.

Un modello è la versione dell’intelligenza artificiale che risponde a quello che scrivi. OpenAI lo presenta come il modello per il lavoro professionale. GPT-6.1 Sol è un aggiornamento di GPT-6 Sol, che era uscito il 22 settembre, una settimana prima.

Il modello più capace di OpenAI resta GPT-6 Astra, presentato il 3 settembre. OpenAI scrive che GPT-6.1 Sol si avvicina all’intelligenza di Astra a circa un quinto del prezzo.

Il giorno prima, lunedì 28 settembre 2026, Anthropic, l’azienda che fa Claude, aveva rilasciato Claude Sonnet 5.5. Costa quanto GPT-6.1 Sol: per questo li metto a confronto.

Quanto costa

Il prezzo si conta in token, cioè i pezzetti di testo che il modello legge e scrive. Prezzi di listino, in dollari ogni milione di token.

ModelloLegge (ingresso)Scrive (uscita)
GPT-6.1 Sol2 $10 $
Claude Sonnet 5.52 $10 $
Claude Opus 5.54 $20 $
GPT-6 Astra10 $50 $

GPT-6.1 Sol costa quanto Sonnet 5.5, la metà di Opus 5.5 e un quinto di Astra.

Ci guadagna chi collega il modello ai propri programmi. Lo fa con l’API, il collegamento tecnico, e paga a consumo.

Chi ha un abbonamento paga un importo fisso: per lui contano i punteggi della sezione dopo.

Con richieste molto lunghe, oltre 272.000 token, cioè centinaia di pagine, il prezzo di GPT-6.1 Sol sale. Passa a 4 $ per quello che legge e 15 $ per quello che scrive.

Sonnet 5.5 resta a 2 $ e 10 $ anche con richieste lunghe.

I numeri: dipende da quanto lo fai ragionare

Il test si chiama AutomationBench. Lo ha fatto Zapier, l’azienda che collega tra loro i programmi di lavoro. Dà ai modelli compiti di lavoro in più passaggi, da fare su strumenti aziendali.

Ogni modello si prova a più livelli di ragionamento, cioè a quanto lo lasci ragionare prima di rispondere. È come dare lo stesso lavoro a un collaboratore: di corsa, con calma, con tutto il tempo.

Il test ha cinque livelli. Qui ne mostro tre: basso, medio, massimo.

Il punteggio è una percentuale: più è alta, meglio il modello ha svolto i compiti. È un test difficile: il punteggio più alto in classifica oggi è 44,8%.

Tra parentesi c’è il costo medio di un compito. In grassetto, il punteggio migliore di ogni livello.

ModelloLivello bassoLivello medioLivello massimo
GPT-6.1 Sol24,7% (0,16 $)31,7% (0,19 $)36,1% (0,30 $)
Claude Sonnet 5.518,3% (0,28 $)23,3% (0,31 $)44,8% (1,14 $)
Claude Opus 5.524,2% (0,51 $)29,5% (0,65 $)42,5% (1,44 $)

Al livello medio GPT-6.1 Sol fa meglio dei due Claude e costa meno. Al livello massimo fanno meglio i due Claude. Sonnet 5.5 costa quasi quattro volte di più a compito: 1,14 $ contro 0,30 $.

Il prezzo di listino è lo stesso. Cambia quanto ragionano, e quindi quanto costa un compito.

Per il lavoro di ogni giorno conta il livello medio. Il massimo serve quando controlli dei numeri o il documento va al cliente.

In Claude il livello si regola con la voce Impegno, accanto al nome del modello. In ChatGPT Work c’è una regolazione dello stesso tipo.

I numeri di GPT-6.1 Sol sono dati di OpenAI, letti dal grafico dell’annuncio. Quelli dei Claude vengono dalla classifica pubblica di Zapier, dove quelli di GPT-6.1 Sol non compaiono ancora.

Come leggere un confronto tra modelli

Tre domande per ogni confronto. Qui ognuna ha la sua risposta.

  1. Contro chi? OpenAI confronta GPT-6.1 Sol con Claude Opus 5.5, la versione grande di Claude. Io l’ho messo contro Sonnet 5.5, il suo concorrente diretto: costa quanto lui. Opus 5.5 costa il doppio: è un confronto diverso da quello con chi costa uguale.
  2. Con quali impostazioni? Al livello medio OpenAI dichiara 2,2 punti percentuali di vantaggio su Opus 5.5, a circa un terzo del costo. Al livello massimo Opus 5.5 sta davanti di 6,4 punti percentuali: 42,5% contro 36,1%. Stesso test, verdetto opposto. Nel testo dell’annuncio OpenAI mette in evidenza il livello medio. Il grafico mostra anche gli altri livelli.
  3. Chi ha misurato? Per GPT-6.1 Sol, OpenAI. Per i Claude, la classifica pubblica di Zapier. Nella tabella ci sono due fonti.

Dove si trova

  • In ChatGPT Work, la parte di ChatGPT per il lavoro, e in Codex. Nella Chat normale di ChatGPT non c’è.
  • Nei piani Plus, Pro, Business, Enterprise ed Edu. Free e Go, al lancio, non lo hanno.
  • In Enterprise ed Edu resta spento finché l’amministratore non lo abilita.

L’arrivo è graduale: se non lo vedi ancora, arriva nei giorni seguenti.

Nell’app per computer il modello si sceglie sotto il campo dove scrivi. Scegli GPT-6.1 Sol.

Codex esiste come app per Mac e Windows e dentro i programmi per scrivere codice. Esiste anche nel terminale, la finestra dove scrivi i comandi.

Il 14 ottobre 2026 OpenAI ritira GPT-5.5

Mercoledì 14 ottobre 2026 OpenAI ritira GPT-5.5 da ChatGPT, da ChatGPT Work e da Codex. Lo ha annunciato il 14 settembre e indica GPT-6 Sol come sostituto. L’API, il collegamento per i programmi, non cambia.

Controlla dove GPT-5.5 è il modello predefinito, cioè quello che parte se non ne scegli un altro:

  • In un agente, l’assistente AI preparato per un lavoro.
  • In un’attività pianificata, il lavoro che parte da solo a un orario.

Lì va cambiato prima del 14 ottobre.

Cosa in Italia non c’è ancora

  • Gli agenti dots, quelli sempre attivi. Per gli abbonati Pro, al lancio, non sono disponibili nello Spazio Economico Europeo, in Svizzera e nel Regno Unito. Quindi in Italia non ci sono. Per Business Premium in Italia non c’è conferma.
  • GPT-6.1 Sol Ultrafast, la versione più veloce, non è ancora stato lanciato. OpenAI scrive che arriva nei prossimi giorni. Alcune pagine italiane di OpenAI lo danno per già disponibile: sono indietro rispetto all’originale inglese.

La lezione

Un confronto tra modelli vale solo se sai contro chi, con quali impostazioni e chi ha misurato. Se ne manca una, decide la tua prova.

Come usarlo da domani

  1. Il compito. Un lavoro che rifai ogni settimana. Servono tre cose: un esempio da seguire, il file con i dati veri e il criterio di finito. Il criterio di finito dice cosa deve essere vero perché tu lo mandi così com’è. Per esempio: i totali tornano con il tuo listino prezzi.
  2. Due modelli, stessa impostazione. GPT-6.1 Sol e Claude Sonnet 5.5, tutti e due sull’impostazione di base, quella che trovi già selezionata. In Claude è la voce Impegno, su Medio. Se hai solo la Chat normale di ChatGPT, provala due volte. Una con l’impostazione di base, una con una più alta.
  3. Conta le correzioni. Quante volte devi correggere prima di mandare il risultato. Vince chi te ne chiede meno.

Per tenere il conto, riempi una tabellina così:

CompitoCorrezioni con GPT-6.1 SolCorrezioni con Claude Sonnet 5.5
   
   

Cosa faccio io

Il 22 settembre GPT-6 Sol, il modello di prima, è uscito lo stesso giorno di Claude Opus 5.5. Il tempismo mi è sembrato una mossa per togliere spazio al lancio di Anthropic.

GPT-6 Sol non ha soddisfatto le mie aspettative, quindi GPT-6.1 Sol lo provo io prima di fidarmi. Fai lo stesso con la prova qui sopra.

Il calendario dei lanci lo decidono le aziende. Il modello lo scegli tu, con la tua prova.

Fonti, per nome:

  • annuncio ufficiale di OpenAI «Introducing GPT-6.1 Sol» del 29 settembre 2026
  • note di rilascio di ChatGPT
  • elenco delle modifiche (il changelog) dell’API di OpenAI
  • pagina prezzi dell’API di OpenAI
  • classifica AutomationBench 1.0.6 di Zapier
  • annuncio «Claude Sonnet 5.5» di Anthropic del 28 settembre 2026
  • pagina modelli e prezzi di Anthropic

Di questo si parla ogni settimana dentro AI con Sal.
Entra nella community

Articoli simili

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *