Evaluaciones comparativas

Evaluaciones comparativas y metodología.

Cómo se compara ChatGPT-6 con la frontera actual: la tabla completa, las salvedades detrás de cada cifra y exactamente cómo lo elaboramos.

Última actualización: septiembre de 2026

La mayoría de las tablas comparativas te dan un veredicto sin mostrar las pruebas. Esta muestra los números y luego te dice de dónde vienen, qué no pueden decirte y por qué una vista previa gratuita cambia las cuentas.

ChatGPT-6 es una vista previa de acceso anticipado, así que considera sus cifras orientativas y no definitivas: la forma honesta de leer esta página es «calidad de nivel frontera a un precio que ningún modelo de pago puede igualar».

La tabla completa

Nueve dimensiones, cinco modelos, una columna gratuita.

Metric
ChatGPT-6
GPT-5.6
Opus 5
Gemini 3.7
Grok 4.6
Índice de inteligencia71*67686665
Programación agéntica86*84827876
Ventana de contexto400K400K1M2M500K
Salida máxima128K128K64K64K64K
Rendimiento (tps)58*705592120
Precio / 1M de salida$0$10$25$10$6
Multimodal
Pesos abiertos
Uso gratuito
Índice de inteligencia

Puntuación compuesta en pruebas de razonamiento, conocimientos y matemáticas (cuanto más alta, mejor).

Programación agéntica

Puntuación orientativa de programación agéntica: tareas del mundo real con varios archivos y herramientas (cuanto más alta, mejor).

Ventana de contexto

Número máximo de tokens a los que el modelo puede prestar atención en una sola conversación.

Salida máxima

La respuesta más larga que el modelo generará en una sola llamada.

Rendimiento (tps)

Velocidad de salida media en tokens por segundo (cuanto más alta, más rápido).

Precio / 1M de salida

Precio de lista por millón de tokens de salida (más bajo es más barato).

Multimodal

Acepta imágenes como entrada junto con texto.

Pesos abiertos

Los pesos se pueden descargar y alojar por cuenta propia.

Uso gratuito

Se puede usar sin costo por ahora.

Metodología

El Índice de inteligencia es un compuesto de benchmarks públicos de razonamiento, conocimiento y matemáticas, inspirado en el Artificial Analysis Intelligence Index. La programación agéntica refleja tareas reales de varios archivos ejecutadas con herramientas, en lugar de fragmentos aislados.

La ventana de contexto, la salida máxima, el rendimiento y el precio son cifras comunicadas por los proveedores. El precio es la tarifa de lista por un millón de tokens de salida; los tokens de entrada suelen ser más baratos y se omiten para mantener la tabla legible.

ChatGPT-6 está en vista previa de acceso anticipado, por lo que sus cifras (marcadas con *) son estimaciones comunicadas por la comunidad, no datos de una ficha técnica del proveedor. Cambiarán a medida que se ajuste el modelo; actualizamos esta página cuando aparecen datos mejores.

Las cifras cambian rápido en este sector. Usa esto como guía orientativa para elegir un modelo, no como una clasificación definitiva de benchmarks. En caso de duda, ejecuta tu propia evaluación con tus propios prompts.

Compruébalo por ti mismo

Las cifras son una cosa. Dale a ChatGPT-6 una tarea real y evalúa el resultado.

Abrir el chat