Benchmarks
Benchmarks et méthodologie.
Comment ChatGPT-6 se positionne face aux modèles de pointe actuels — le tableau complet, les réserves derrière chaque chiffre et la manière exacte dont nous l’avons élaboré.
Dernière mise à jour : septembre 2026
La plupart des tableaux comparatifs vous donnent un verdict sans fournir les preuves. Celui-ci présente les chiffres, puis vous explique d’où ils viennent, ce qu’ils ne peuvent pas vous dire et pourquoi un aperçu gratuit change les calculs.
ChatGPT-6 est un aperçu en accès anticipé : considérez donc ses chiffres comme indicatifs plutôt que définitifs — la façon honnête de lire cette page est la suivante : « une qualité de niveau frontière à un prix qu’aucun modèle payant ne peut égaler ».
Le tableau complet
Neuf dimensions, cinq modèles, une colonne gratuite.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Indice d’intelligence | 71* | 67 | 68 | 66 | 65 |
| Codage agentique | 86* | 84 | 82 | 78 | 76 |
| Fenêtre de contexte | 400K | 400K | 1M | 2M | 500K |
| Sortie maximale | 128K | 128K | 64K | 64K | 64K |
| Débit (tps) | 58* | 70 | 55 | 92 | 120 |
| Prix / 1M en sortie | $0 | $10 | $25 | $10 | $6 |
| Multimodal | |||||
| Poids ouverts | |||||
| Utilisation gratuite |
Score composite basé sur des benchmarks de raisonnement, de connaissances et de mathématiques (plus il est élevé, meilleur est le résultat).
Score indicatif de codage agentique — tâches réelles impliquant plusieurs fichiers et des outils (plus il est élevé, meilleur est le résultat).
Nombre maximal de tokens auxquels le modèle peut accéder au cours d’une seule conversation.
Réponse la plus longue que le modèle générera en un seul appel.
Vitesse de sortie médiane en tokens par seconde (plus elle est élevée, plus la vitesse est grande).
Prix catalogue par million de tokens de sortie (moins cher = mieux).
Accepte les images en entrée en plus du texte.
Les poids peuvent être téléchargés et hébergés en propre.
Utilisable gratuitement dès maintenant.
Face-à-face
Vous voulez une comparaison ciblée, en tête-à-tête ? Choisissez un duel.
Méthodologie
L’Indice d’intelligence est un composite de benchmarks publics de raisonnement, de connaissances et de mathématiques, dans l’esprit de l’Artificial Analysis Intelligence Index. Le codage agentique reflète des tâches réelles impliquant plusieurs fichiers et exécutées avec des outils, plutôt que des extraits isolés.
La fenêtre de contexte, la sortie maximale, le débit et le prix sont des chiffres communiqués par les fournisseurs. Le prix correspond au tarif catalogue par million de tokens de sortie ; les tokens d’entrée sont généralement moins chers et sont omis pour préserver la lisibilité du tableau.
ChatGPT-6 est disponible en aperçu anticipé, ses chiffres (marqués d’un *) sont donc des estimations communiquées par la communauté plutôt que des données provenant d’une fiche technique fournisseur. Ils évolueront au fur et à mesure du réglage du modèle — nous actualisons cette page à mesure que de meilleures données apparaissent.
Les chiffres évoluent vite dans ce domaine. Utilisez ceci comme un guide indicatif pour choisir un modèle, et non comme un classement de référence des benchmarks. En cas de doute, effectuez votre propre évaluation avec vos propres prompts.
Voyez par vous-même
Les chiffres ne font pas tout. Donnez une vraie tâche à ChatGPT-6 et évaluez le résultat.