Benchmark

Benchmark e metodologia.

Come si posiziona ChatGPT-6 rispetto alla frontiera attuale — la tabella completa, le limitazioni dietro ogni numero e come l'abbiamo realizzata, nel dettaglio.

Ultimo aggiornamento: settembre 2026

La maggior parte delle tabelle comparative dà un verdetto senza mostrare le prove. Questa mostra i numeri e poi spiega da dove provengono, cosa non possono dirti e perché un’anteprima gratuita cambia i calcoli.

ChatGPT-6 è un’anteprima ad accesso anticipato, quindi considera i suoi dati indicativi anziché definitivi — il modo corretto di leggere questa pagina è: "qualità di livello frontier a un prezzo che nessun modello a pagamento può eguagliare."

La tabella completa

Nove dimensioni, cinque modelli, una colonna gratuita.

Metric
ChatGPT-6
GPT-5.6
Opus 5
Gemini 3.7
Grok 4.6
Indice di intelligenza71*67686665
Programmazione agentica86*84827876
Finestra di contesto400K400K1M2M500K
Output massimo128K128K64K64K64K
Velocità di elaborazione (tps)58*705592120
Prezzo / 1M output$0$10$25$10$6
Multimodale
Pesi aperti
Utilizzabile gratuitamente
Indice di intelligenza

Punteggio composito basato su benchmark di ragionamento, conoscenza e matematica (più alto è meglio).

Programmazione agentica

Punteggio indicativo di programmazione agentica — attività reali su più file con strumenti (più alto è meglio).

Finestra di contesto

Numero massimo di token che il modello può considerare in una singola conversazione.

Output massimo

La risposta più lunga che il modello genererà in una singola chiamata.

Velocità di elaborazione (tps)

Velocità mediana di output in token al secondo (più alta è più veloce).

Prezzo / 1M output

Prezzo di listino per milione di token in output (più basso significa più conveniente).

Multimodale

Accetta immagini in input insieme al testo.

Pesi aperti

I pesi possono essere scaricati ed eseguiti in autonomia.

Utilizzabile gratuitamente

Utilizzabile gratuitamente al momento.

Metodologia

L'Intelligence Index è un indice composito basato su benchmark pubblici di ragionamento, conoscenza e matematica, nello spirito dell'Artificial Analysis Intelligence Index. La programmazione agentica riflette attività reali su più file eseguite con strumenti, anziché snippet isolati.

La finestra di contesto, l'output massimo, il throughput e il prezzo sono dati riportati dai fornitori. Il prezzo è la tariffa di listino per un milione di token in output; i token in input sono solitamente più economici e vengono omessi per mantenere la tabella leggibile.

ChatGPT-6 è disponibile in anteprima ad accesso anticipato, quindi i suoi dati (contrassegnati da *) sono stime riportate dalla community e non provengono da una scheda tecnica del fornitore. Cambieranno man mano che il modello verrà ottimizzato: aggiorniamo questa pagina quando emergono dati migliori.

In questo settore i numeri cambiano rapidamente. Usa questa guida come riferimento indicativo per scegliere un modello, non come classifica ufficiale dei benchmark. In caso di dubbi, esegui la tua valutazione sui tuoi prompt.

Verificalo di persona

I numeri sono una cosa. Affida a ChatGPT-6 un'attività reale e valuta l'output.

Apri la chat