Benchmark
Benchmark e metodologia.
Come si posiziona ChatGPT-6 rispetto alla frontiera attuale — la tabella completa, le limitazioni dietro ogni numero e come l'abbiamo realizzata, nel dettaglio.
Ultimo aggiornamento: settembre 2026
La maggior parte delle tabelle comparative dà un verdetto senza mostrare le prove. Questa mostra i numeri e poi spiega da dove provengono, cosa non possono dirti e perché un’anteprima gratuita cambia i calcoli.
ChatGPT-6 è un’anteprima ad accesso anticipato, quindi considera i suoi dati indicativi anziché definitivi — il modo corretto di leggere questa pagina è: "qualità di livello frontier a un prezzo che nessun modello a pagamento può eguagliare."
La tabella completa
Nove dimensioni, cinque modelli, una colonna gratuita.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Indice di intelligenza | 71* | 67 | 68 | 66 | 65 |
| Programmazione agentica | 86* | 84 | 82 | 78 | 76 |
| Finestra di contesto | 400K | 400K | 1M | 2M | 500K |
| Output massimo | 128K | 128K | 64K | 64K | 64K |
| Velocità di elaborazione (tps) | 58* | 70 | 55 | 92 | 120 |
| Prezzo / 1M output | $0 | $10 | $25 | $10 | $6 |
| Multimodale | |||||
| Pesi aperti | |||||
| Utilizzabile gratuitamente |
Punteggio composito basato su benchmark di ragionamento, conoscenza e matematica (più alto è meglio).
Punteggio indicativo di programmazione agentica — attività reali su più file con strumenti (più alto è meglio).
Numero massimo di token che il modello può considerare in una singola conversazione.
La risposta più lunga che il modello genererà in una singola chiamata.
Velocità mediana di output in token al secondo (più alta è più veloce).
Prezzo di listino per milione di token in output (più basso significa più conveniente).
Accetta immagini in input insieme al testo.
I pesi possono essere scaricati ed eseguiti in autonomia.
Utilizzabile gratuitamente al momento.
Confronto diretto
Vuoi un'analisi mirata faccia a faccia? Scegli un confronto.
Metodologia
L'Intelligence Index è un indice composito basato su benchmark pubblici di ragionamento, conoscenza e matematica, nello spirito dell'Artificial Analysis Intelligence Index. La programmazione agentica riflette attività reali su più file eseguite con strumenti, anziché snippet isolati.
La finestra di contesto, l'output massimo, il throughput e il prezzo sono dati riportati dai fornitori. Il prezzo è la tariffa di listino per un milione di token in output; i token in input sono solitamente più economici e vengono omessi per mantenere la tabella leggibile.
ChatGPT-6 è disponibile in anteprima ad accesso anticipato, quindi i suoi dati (contrassegnati da *) sono stime riportate dalla community e non provengono da una scheda tecnica del fornitore. Cambieranno man mano che il modello verrà ottimizzato: aggiorniamo questa pagina quando emergono dati migliori.
In questo settore i numeri cambiano rapidamente. Usa questa guida come riferimento indicativo per scegliere un modello, non come classifica ufficiale dei benchmark. In caso di dubbi, esegui la tua valutazione sui tuoi prompt.
Verificalo di persona
I numeri sono una cosa. Affida a ChatGPT-6 un'attività reale e valuta l'output.