Benchmarks
Benchmarks en methodologie.
Hoe ChatGPT-6 zich verhoudt tot de huidige topmodellen — de volledige tabel, de kanttekeningen bij elk getal en precies hoe we alles hebben samengesteld.
Laatst bijgewerkt: september 2026
De meeste vergelijkingstabellen geven je een oordeel zonder de onderbouwing te laten zien. Deze tabel toont de cijfers en vertelt vervolgens waar ze vandaan komen, wat ze je niet kunnen vertellen en waarom een gratis preview de berekening verandert.
ChatGPT-6 is een preview met vroege toegang, dus beschouw de cijfers als indicatief en niet als definitief — de eerlijke manier om deze pagina te lezen is: "kwaliteit op frontierniveau voor een prijs die geen enkel betaald model kan evenaren."
De volledige tabel
Negen dimensies, vijf modellen, één gratis kolom.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Intelligentie-index | 71* | 67 | 68 | 66 | 65 |
| Agentic programmeren | 86* | 84 | 82 | 78 | 76 |
| Contextvenster | 400K | 400K | 1M | 2M | 500K |
| Maximale uitvoer | 128K | 128K | 64K | 64K | 64K |
| Doorvoer (tps) | 58* | 70 | 55 | 92 | 120 |
| Prijs / 1M uitvoer | $0 | $10 | $25 | $10 | $6 |
| Multimodaal | |||||
| Open gewichten | |||||
| Gratis te gebruiken |
Samengestelde score voor redeneer-, kennis- en wiskundebenchmarks (hoger is beter).
Indicatieve score voor agentic programmeren — realistische taken met meerdere bestanden en tools (hoger is beter).
Maximumaantal tokens waaraan het model in één gesprek aandacht kan besteden.
Langste antwoord dat het model in één keer genereert.
Mediane uitvoersnelheid in tokens per seconde (hoger is sneller).
Catalogusprijs per miljoen outputtokens (lager is goedkoper).
Accepteert afbeeldingsinvoer naast tekst.
Gewichten kunnen worden gedownload en zelf worden gehost.
Momenteel gratis te gebruiken.
Rechtstreekse vergelijking
Wil je een gerichte, een-op-eenvergelijking? Kies een confrontatie.
Methodologie
Intelligence Index is een samengestelde score van openbare benchmarks voor redeneren, kennis en wiskunde, in de geest van de Artificial Analysis Intelligence Index. Agentic coding weerspiegelt realistische taken met meerdere bestanden die met tools worden uitgevoerd, in plaats van geïsoleerde codefragmenten.
Contextvenster, maximale output, doorvoer en prijs zijn door providers opgegeven cijfers. De prijs is het standaardtarief per één miljoen outputtokens; inputtokens zijn doorgaans goedkoper en zijn weggelaten om de tabel leesbaar te houden.
ChatGPT-6 bevindt zich in een preview met vroege toegang, dus de cijfers (gemarkeerd met *) zijn schattingen uit de community en geen gegevensblad van de leverancier. Ze veranderen naarmate het model verder wordt afgestemd — we vernieuwen deze pagina zodra er betere gegevens beschikbaar zijn.
Cijfers veranderen snel in deze sector. Gebruik dit als richtinggevende leidraad bij het kiezen van een model, niet als officiële benchmarkranglijst. Voer bij twijfel je eigen evaluatie uit met je eigen prompts.
Oordeel zelf
Cijfers zijn één ding. Geef ChatGPT-6 een echte taak en beoordeel de output.