Benchmarks

Benchmarks et méthodologie.

Comment ChatGPT-6 se positionne face aux modèles de pointe actuels — le tableau complet, les réserves derrière chaque chiffre et la manière exacte dont nous l’avons élaboré.

Dernière mise à jour : septembre 2026

La plupart des tableaux comparatifs vous donnent un verdict sans fournir les preuves. Celui-ci présente les chiffres, puis vous explique d’où ils viennent, ce qu’ils ne peuvent pas vous dire et pourquoi un aperçu gratuit change les calculs.

ChatGPT-6 est un aperçu en accès anticipé : considérez donc ses chiffres comme indicatifs plutôt que définitifs — la façon honnête de lire cette page est la suivante : « une qualité de niveau frontière à un prix qu’aucun modèle payant ne peut égaler ».

Le tableau complet

Neuf dimensions, cinq modèles, une colonne gratuite.

Metric
ChatGPT-6
GPT-5.6
Opus 5
Gemini 3.7
Grok 4.6
Indice d’intelligence71*67686665
Codage agentique86*84827876
Fenêtre de contexte400K400K1M2M500K
Sortie maximale128K128K64K64K64K
Débit (tps)58*705592120
Prix / 1M en sortie$0$10$25$10$6
Multimodal
Poids ouverts
Utilisation gratuite
Indice d’intelligence

Score composite basé sur des benchmarks de raisonnement, de connaissances et de mathématiques (plus il est élevé, meilleur est le résultat).

Codage agentique

Score indicatif de codage agentique — tâches réelles impliquant plusieurs fichiers et des outils (plus il est élevé, meilleur est le résultat).

Fenêtre de contexte

Nombre maximal de tokens auxquels le modèle peut accéder au cours d’une seule conversation.

Sortie maximale

Réponse la plus longue que le modèle générera en un seul appel.

Débit (tps)

Vitesse de sortie médiane en tokens par seconde (plus elle est élevée, plus la vitesse est grande).

Prix / 1M en sortie

Prix catalogue par million de tokens de sortie (moins cher = mieux).

Multimodal

Accepte les images en entrée en plus du texte.

Poids ouverts

Les poids peuvent être téléchargés et hébergés en propre.

Utilisation gratuite

Utilisable gratuitement dès maintenant.

Méthodologie

L’Indice d’intelligence est un composite de benchmarks publics de raisonnement, de connaissances et de mathématiques, dans l’esprit de l’Artificial Analysis Intelligence Index. Le codage agentique reflète des tâches réelles impliquant plusieurs fichiers et exécutées avec des outils, plutôt que des extraits isolés.

La fenêtre de contexte, la sortie maximale, le débit et le prix sont des chiffres communiqués par les fournisseurs. Le prix correspond au tarif catalogue par million de tokens de sortie ; les tokens d’entrée sont généralement moins chers et sont omis pour préserver la lisibilité du tableau.

ChatGPT-6 est disponible en aperçu anticipé, ses chiffres (marqués d’un *) sont donc des estimations communiquées par la communauté plutôt que des données provenant d’une fiche technique fournisseur. Ils évolueront au fur et à mesure du réglage du modèle — nous actualisons cette page à mesure que de meilleures données apparaissent.

Les chiffres évoluent vite dans ce domaine. Utilisez ceci comme un guide indicatif pour choisir un modèle, et non comme un classement de référence des benchmarks. En cas de doute, effectuez votre propre évaluation avec vos propres prompts.

Voyez par vous-même

Les chiffres ne font pas tout. Donnez une vraie tâche à ChatGPT-6 et évaluez le résultat.

Ouvrir le chat