Anthropic e OpenAI hanno presentato i rispettivi nuovi modelli di intelligenza artificiale nella stessa giornata, martedì 22 settembre 2026. I primi benchmark indipendenti vedono Claude Opus 5.5 in vantaggio nella maggior parte dei test, mentre GPT-6 Sol si distingue soprattutto per costi di utilizzo decisamente più contenuti.
I due annunci sono arrivati a circa 90 minuti di distanza. Anthropic ha anticipato la rivale presentando Claude Opus 5.5, il suo modello pubblico più potente dopo Fable 5.1, con il quale, secondo l’azienda, offre prestazioni sostanzialmente comparabili. Poco dopo OpenAI ha svelato GPT-6 Sol, variante più economica del modello di punta GPT-6 Astra.
Le strategie appaiono quindi differenti: Anthropic punta soprattutto sulle prestazioni, mentre OpenAI mette l’accento sull’efficienza economica. Per programmatori, aziende che elaborano grandi quantità di documenti o servizi basati su assistenti virtuali, la scelta può dipendere proprio da questo equilibrio.
Entrambi i modelli permettono inoltre di regolare lo “sforzo” attraverso un apposito cursore, passando dalle modalità meno costose a quelle più avanzate. Questa impostazione determina, in sostanza, quanto tempo l’intelligenza artificiale dedica all’elaborazione prima di fornire una risposta.
Claude Opus 5.5 e GPT-6 Sol sono disponibili dal 22 settembre. Il modello Anthropic può essere utilizzato tramite API Anthropic, Amazon Bedrock, Google Cloud Vertex AI e Microsoft Foundry, oltre che con gli abbonamenti Claude Pro, Max, Team ed Enterprise. Non è invece incluso nell’offerta gratuita. GPT-6 Sol è disponibile attraverso l’API OpenAI, ChatGPT Work e Codex, ma al momento non nella modalità chat standard di ChatGPT.
Prezzi e caratteristiche di Claude Opus 5.5 e GPT-6 Sol
Il confronto economico si basa sui token, ossia le unità di testo utilizzate per calcolare il costo delle richieste in ingresso e delle risposte generate. Per Claude Opus 5.5 Anthropic applica un prezzo di 4 dollari per milione di token in input e 20 dollari per milione in output. GPT-6 Sol costa esattamente la metà: rispettivamente 2 e 10 dollari.
Anthropic sostiene inoltre che Opus 5.5 permetta di risparmiare il 40% rispetto a Opus 5. OpenAI, invece, dichiara che GPT-6 Sol commette circa la metà degli errori fattuali registrati dal suo predecessore.
| Caratteristiche | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|
| Sviluppatore | Anthropic | OpenAI |
| Input per milione di token | 4 $ (circa 3,50 €) | 2 $ (circa 1,75 €) |
| Output per milione di token | 20 $ (circa 17,40 €) | 10 $ (circa 8,70 €) |
| Costo per attività al massimo sforzo | 5,98 $ (circa 5,20 €) | 1,06 $ (circa 0,92 €) |
| Contesto massimo | 1 milione di token | 1,05 milioni di token |
Sulla carta, dunque, Sol costa la metà per token. I benchmark indipendenti evidenziano però differenze ancora più marcate, sia sul fronte delle prestazioni sia considerando il costo effettivo necessario per completare un’attività.
Confrontare i grafici pubblicati direttamente dalle due aziende non è semplice. Nessuna delle due ha infatti sottoposto ai propri test il nuovo modello della concorrente, probabilmente proprio perché gli annunci sono avvenuti nella stessa giornata. OpenAI confronta GPT-6 Sol con Claude Opus 5, mentre Anthropic mette Opus 5.5 a confronto con GPT-6 Astra e con il precedente GPT-5.6 Sol.
Di conseguenza, i due annunci condividono pochissimi benchmark e, anche quando viene utilizzato un test con lo stesso nome, le condizioni di misurazione possono essere differenti. La stessa Anthropic riconosce il problema nel proprio comunicato, sottolineando che, raggiunti questi livelli di prestazioni, gli scostamenti nei benchmark sono diventati “un indicatore meno affidabile delle differenze reali”.
Claude Opus 5.5 avanti nei benchmark indipendenti
Per mettere i due modelli sullo stesso piano è necessario ricorrere a test standardizzati condotti nelle medesime condizioni. Artificial Analysis, piattaforma specializzata nella valutazione dei sistemi di intelligenza artificiale, ha effettuato questo confronto e assegna a Claude Opus 5.5 un punteggio di 58 con lo sforzo massimo, contro i 48 punti ottenuti da GPT-6 Sol. A parità di impostazione, il vantaggio di Opus si mantiene generalmente tra 8 e 12 punti.
| Benchmark | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|
| Artificial Analysis Intelligence Index, massimo sforzo | 58 | 48 |
Un altro dato significativo emerge utilizzando Claude Opus 5.5 con uno sforzo medio: in questa configurazione raggiunge 51 punti, superando quindi GPT-6 Sol impostato al massimo. Anche considerando separatamente diversi ambiti professionali, Artificial Analysis vede Opus davanti: 61 punti contro 48 nella finanza, 63 contro 51 nel diritto e 60 contro 49 nell’ingegneria.
Va però considerato un dettaglio importante nella lettura dei risultati. Artificial Analysis ha valutato Opus 5.5 mantenendo attivo il sistema di fallback previsto di default da Anthropic. Se un filtro di sicurezza impedisce di gestire una determinata richiesta, per esempio nel campo della sicurezza informatica, il compito può essere trasferito a un modello precedente come Claude Opus 4.8. I risultati rappresentano quindi il servizio complessivamente fornito da Anthropic e non esclusivamente le capacità di Opus 5.5.
GPT-6 Sol costa meno, ma il vantaggio dipende dall’utilizzo
Il prezzo per token di GPT-6 Sol è dimezzato rispetto a quello di Claude Opus 5.5, ma nell’uso concreto la differenza può diventare ancora maggiore. Con lo sforzo massimo, un’attività del benchmark di Artificial Analysis costa mediamente 5,98 dollari, circa 5,20 euro, utilizzando Opus 5.5. Con Sol la stessa operazione costa mediamente 1,06 dollari, circa 0,92 euro: quasi sei volte meno.
Una delle ragioni è la quantità di elaborazione effettuata. Al massimo livello di sforzo, Opus 5.5 impiega più tempo e genera circa quattro volte il numero di token utilizzati da Sol per svolgere lo stesso compito: circa 119.000 contro una media di 31.000.
Anche la velocità iniziale favorisce il modello di OpenAI. Con uno sforzo medio, GPT-6 Sol comincia a generare la risposta dopo circa 2 secondi, mentre Claude Opus 5.5 necessita di circa 20 secondi. Sol raggiunge inoltre 114 token al secondo contro i 78 token al secondo di Opus.
Il vantaggio economico di GPT-6 Sol non vale però allo stesso modo a ogni livello di prestazioni. Fino a circa 44 punti nell’indice di Artificial Analysis, Sol rappresenta la soluzione meno costosa per raggiungere un determinato risultato. Superata questa soglia, le sue prestazioni tendono a stabilizzarsi, mentre quelle di Opus continuano ad aumentare. Claude Opus 5.5 configurato con uno sforzo medio costa soltanto il 26% in più rispetto a GPT-6 Sol impostato al massimo, ottenendo al tempo stesso circa 3 punti aggiuntivi.
La scelta dipende quindi principalmente dal tipo di attività. Per operazioni di programmazione complesse, analisi finanziarie o legali e richieste nelle quali la precisione rappresenta un requisito fondamentale, Claude Opus 5.5 offre prestazioni superiori che possono compensare il maggiore costo.
Per chatbot, servizi di assistenza clienti, applicazioni caratterizzate da volumi elevati o automazioni relativamente semplici, GPT-6 Sol offre invece prestazioni vicine a quelle del concorrente con una spesa notevolmente inferiore e tempi di risposta più rapidi, soprattutto utilizzando livelli di sforzo bassi o medi.
Resta infine un elemento da considerare: i punteggi pubblicati da Artificial Analysis possono variare nei giorni immediatamente successivi al debutto di un nuovo modello. Le distanze registrate tra Claude Opus 5.5 e GPT-6 Sol potrebbero quindi cambiare con l’arrivo di ulteriori test.

