Claude Opus 5.5 o GPT-6 Sol: come scegliere guardando i numeri giusti
Martedì 22 settembre 2026 sono usciti due modelli nuovi, nello stesso giorno. Anthropic ha lanciato Claude Opus 5.5. OpenAI ha risposto con GPT-6 Sol, in arrivo in ChatGPT Work e Codex.
Ho messo a confronto i numeri che le due aziende hanno pubblicato. Tra i tanti test, uno solo è in comune: quello sulle automazioni aziendali. È da lì che conviene partire.
Il test che hanno in comune
Sulle automazioni aziendali, stesso test per tutti e due:
- Claude Opus 5.5: 40,0%
- GPT-6 Sol: 33,2%
Qui Claude fa meglio.
Quanto costa un lavoro finito
Il prezzo per milione di parole elaborate dice poco: Claude Opus 5.5 costa 4 dollari in ingresso e 20 in uscita, GPT-6 Sol la metà. Il numero che conta è un altro: quanto costa portare a termine un’attività.
Sullo stesso test, costo per ogni attività:
- Claude Opus 5.5: 1,37 $
- GPT-6 Sol: 0,27 $
Sol costa circa un quinto.
Gli errori
Anthropic ha chiesto ai suoi modelli report con cifre da cercare in rete, e ha bocciato ogni report con anche un solo numero inventato. Opus 5.5 ne consegna 16 su 18 con tutti i numeri giusti. I modelli precedenti, nessuno.
OpenAI dichiara che Sol fa circa la metà degli errori sui fatti rispetto al modello precedente.
Sono due test diversi, uno per azienda: vanno letti uno alla volta.
Il bivio
Claude sbaglia meno e costa di più. Sol costa un quinto e cede qualcosa in qualità.
Il mio criterio:
- se l’errore arriva al cliente (report, numeri, documenti), scegli la precisione;
- se il lavoro si ripete tante volte e il controllo lo fai tu, scegli il costo.
Tre prove per scegliere il tuo
Prendi un lavoro che hai già fatto e dallo a tutti e due.
- Numeri. Controlla ogni cifra con la fonte.
- Regole. Dagli le tue regole di scrittura e guarda chi le rispetta fino all’ultima riga.
- Tempi. Conta minuti e correzioni fino al risultato buono.
Vince chi ti porta al lavoro finito con meno correzioni.
Come lavoriamo noi
Nell’Ecosistema memoria, documenti e procedure della tua azienda stanno in una cartella tua. Claude Code e Codex lavorano sulla stessa cartella.
Così il bivio resta aperto: quando esce un modello migliore, lo provi sul tuo lavoro con il contesto già pronto.
Di questo si parla ogni settimana dentro AI con Sal.
Entra nella community

