Evaluaciones comparativas
Evaluaciones comparativas y metodología.
Cómo se compara ChatGPT-6 con la frontera actual: la tabla completa, las salvedades detrás de cada cifra y exactamente cómo lo elaboramos.
Última actualización: septiembre de 2026
La mayoría de las tablas comparativas te dan un veredicto sin mostrar las pruebas. Esta muestra los números y luego te dice de dónde vienen, qué no pueden decirte y por qué una vista previa gratuita cambia las cuentas.
ChatGPT-6 es una vista previa de acceso anticipado, así que considera sus cifras orientativas y no definitivas: la forma honesta de leer esta página es «calidad de nivel frontera a un precio que ningún modelo de pago puede igualar».
La tabla completa
Nueve dimensiones, cinco modelos, una columna gratuita.
| Metric | ChatGPT-6 | GPT-5.6 | Opus 5 | Gemini 3.7 | Grok 4.6 |
|---|---|---|---|---|---|
| Índice de inteligencia | 71* | 67 | 68 | 66 | 65 |
| Programación agéntica | 86* | 84 | 82 | 78 | 76 |
| Ventana de contexto | 400K | 400K | 1M | 2M | 500K |
| Salida máxima | 128K | 128K | 64K | 64K | 64K |
| Rendimiento (tps) | 58* | 70 | 55 | 92 | 120 |
| Precio / 1M de salida | $0 | $10 | $25 | $10 | $6 |
| Multimodal | |||||
| Pesos abiertos | |||||
| Uso gratuito |
Puntuación compuesta en pruebas de razonamiento, conocimientos y matemáticas (cuanto más alta, mejor).
Puntuación orientativa de programación agéntica: tareas del mundo real con varios archivos y herramientas (cuanto más alta, mejor).
Número máximo de tokens a los que el modelo puede prestar atención en una sola conversación.
La respuesta más larga que el modelo generará en una sola llamada.
Velocidad de salida media en tokens por segundo (cuanto más alta, más rápido).
Precio de lista por millón de tokens de salida (más bajo es más barato).
Acepta imágenes como entrada junto con texto.
Los pesos se pueden descargar y alojar por cuenta propia.
Se puede usar sin costo por ahora.
Cara a cara
¿Quieres un análisis centrado, uno a uno? Elige un enfrentamiento.
Metodología
El Índice de inteligencia es un compuesto de benchmarks públicos de razonamiento, conocimiento y matemáticas, inspirado en el Artificial Analysis Intelligence Index. La programación agéntica refleja tareas reales de varios archivos ejecutadas con herramientas, en lugar de fragmentos aislados.
La ventana de contexto, la salida máxima, el rendimiento y el precio son cifras comunicadas por los proveedores. El precio es la tarifa de lista por un millón de tokens de salida; los tokens de entrada suelen ser más baratos y se omiten para mantener la tabla legible.
ChatGPT-6 está en vista previa de acceso anticipado, por lo que sus cifras (marcadas con *) son estimaciones comunicadas por la comunidad, no datos de una ficha técnica del proveedor. Cambiarán a medida que se ajuste el modelo; actualizamos esta página cuando aparecen datos mejores.
Las cifras cambian rápido en este sector. Usa esto como guía orientativa para elegir un modelo, no como una clasificación definitiva de benchmarks. En caso de duda, ejecuta tu propia evaluación con tus propios prompts.
Compruébalo por ti mismo
Las cifras son una cosa. Dale a ChatGPT-6 una tarea real y evalúa el resultado.