Benchmarks
Benchmarks e metodologia.
Como o ChatGPT-6 se compara aos modelos de ponta atuais — a tabela completa, as ressalvas por trás de cada número e exatamente como montamos tudo.
Última atualização: setembro de 2026
A maioria das tabelas comparativas apresenta um veredito sem mostrar as evidências. Esta mostra os números e depois explica de onde eles vêm, o que não podem dizer e por que uma prévia gratuita muda os cálculos.
ChatGPT-6 é uma prévia de acesso antecipado, portanto trate seus números como indicativos, não definitivos — a maneira honesta de ler esta página é: "qualidade de nível frontier a um preço que nenhum modelo comercial lançado consegue igualar."
A tabela completa
Nove dimensões, cinco modelos, uma coluna gratuita.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Índice de inteligência | 71* | 67 | 68 | 66 | 65 |
| Codificação agentiva | 86* | 84 | 82 | 78 | 76 |
| Janela de contexto | 400K | 400K | 1M | 2M | 500K |
| Saída máxima | 128K | 128K | 64K | 64K | 64K |
| Vazão (tps) | 58* | 70 | 55 | 92 | 120 |
| Preço / 1M de saída | $0 | $10 | $25 | $10 | $6 |
| Multimodal | |||||
| Pesos abertos | |||||
| Uso gratuito |
Pontuação composta em benchmarks de raciocínio, conhecimento e matemática (quanto maior, melhor).
Pontuação indicativa de codificação agentiva — tarefas do mundo real com vários arquivos e ferramentas (quanto maior, melhor).
Número máximo de tokens aos quais o modelo pode prestar atenção em uma única conversa.
Maior resposta que o modelo gerará em uma única chamada.
Velocidade mediana de saída em tokens por segundo (quanto maior, mais rápido).
Preço de lista por milhão de tokens de saída (quanto menor, mais barato).
Aceita imagens como entrada junto com texto.
Os pesos podem ser baixados e hospedados por você.
Disponível gratuitamente no momento.
Comparação direta
Quer uma análise focada, individual? Escolha um confronto.
Metodologia
O Índice de Inteligência é um composto de benchmarks públicos de raciocínio, conhecimento e matemática, inspirado no Artificial Analysis Intelligence Index. A programação agêntica reflete tarefas reais com vários arquivos, executadas com ferramentas, em vez de snippets isolados.
Janela de contexto, saída máxima, throughput e preço são números informados pelos provedores. O preço é a tarifa de lista por um milhão de tokens de saída; os tokens de entrada geralmente são mais baratos e foram omitidos para manter a tabela legível.
O ChatGPT-6 está em prévia de acesso antecipado, portanto seus números (marcados com *) são estimativas informadas pela comunidade, e não dados de uma ficha técnica do fornecedor. Eles mudarão conforme o modelo for ajustado — atualizamos esta página à medida que dados melhores aparecem.
Os números mudam rapidamente neste setor. Use isto como um guia geral para escolher um modelo, não como um ranking definitivo de benchmarks. Em caso de dúvida, faça sua própria avaliação com seus próprios prompts.
Veja por si mesmo
Os números são uma coisa. Dê ao ChatGPT-6 uma tarefa real e avalie o resultado.