Benchmarks

Benchmarks e metodologia.

Como o ChatGPT-6 se compara aos modelos de ponta atuais — a tabela completa, as ressalvas por trás de cada número e exatamente como montamos tudo.

Última atualização: setembro de 2026

A maioria das tabelas comparativas apresenta um veredito sem mostrar as evidências. Esta mostra os números e depois explica de onde eles vêm, o que não podem dizer e por que uma prévia gratuita muda os cálculos.

ChatGPT-6 é uma prévia de acesso antecipado, portanto trate seus números como indicativos, não definitivos — a maneira honesta de ler esta página é: "qualidade de nível frontier a um preço que nenhum modelo comercial lançado consegue igualar."

A tabela completa

Nove dimensões, cinco modelos, uma coluna gratuita.

Metric
ChatGPT-6
GPT-5.6
Opus 5
Gemini 3.7
Grok 4.6
Índice de inteligência71*67686665
Codificação agentiva86*84827876
Janela de contexto400K400K1M2M500K
Saída máxima128K128K64K64K64K
Vazão (tps)58*705592120
Preço / 1M de saída$0$10$25$10$6
Multimodal
Pesos abertos
Uso gratuito
Índice de inteligência

Pontuação composta em benchmarks de raciocínio, conhecimento e matemática (quanto maior, melhor).

Codificação agentiva

Pontuação indicativa de codificação agentiva — tarefas do mundo real com vários arquivos e ferramentas (quanto maior, melhor).

Janela de contexto

Número máximo de tokens aos quais o modelo pode prestar atenção em uma única conversa.

Saída máxima

Maior resposta que o modelo gerará em uma única chamada.

Vazão (tps)

Velocidade mediana de saída em tokens por segundo (quanto maior, mais rápido).

Preço / 1M de saída

Preço de lista por milhão de tokens de saída (quanto menor, mais barato).

Multimodal

Aceita imagens como entrada junto com texto.

Pesos abertos

Os pesos podem ser baixados e hospedados por você.

Uso gratuito

Disponível gratuitamente no momento.

Metodologia

O Índice de Inteligência é um composto de benchmarks públicos de raciocínio, conhecimento e matemática, inspirado no Artificial Analysis Intelligence Index. A programação agêntica reflete tarefas reais com vários arquivos, executadas com ferramentas, em vez de snippets isolados.

Janela de contexto, saída máxima, throughput e preço são números informados pelos provedores. O preço é a tarifa de lista por um milhão de tokens de saída; os tokens de entrada geralmente são mais baratos e foram omitidos para manter a tabela legível.

O ChatGPT-6 está em prévia de acesso antecipado, portanto seus números (marcados com *) são estimativas informadas pela comunidade, e não dados de uma ficha técnica do fornecedor. Eles mudarão conforme o modelo for ajustado — atualizamos esta página à medida que dados melhores aparecem.

Os números mudam rapidamente neste setor. Use isto como um guia geral para escolher um modelo, não como um ranking definitivo de benchmarks. Em caso de dúvida, faça sua própria avaliação com seus próprios prompts.

Veja por si mesmo

Os números são uma coisa. Dê ao ChatGPT-6 uma tarefa real e avalie o resultado.

Abrir o chat