Ir al contenido principal
Traducción automática en fase de mejora, sin revisión nativa todavía. Informa de errores en GitHub (se abre en una pestaña nueva).
Nuevo

GPT-6 frente a Opus 5.5: lo que dicen de verdad los precios y las cifras

OpenAI lanza GPT-6 Astra el 3 de septiembre de 2026 y luego Sol y Luna el 22, el mismo día que Opus 5.5. Tarifas oficiales, benchmarks disponibles y trampas de comparación, sin tomar partido.

  • Comparativa
  • Rendimiento
Publicado el

En resumen

Septiembre de 2026 vio dos grandes lanzamientos el mismo día. El 22 de septiembre, Anthropic publicó Claude Opus 5.5 y OpenAI publicó GPT-6 Sol y GPT-6 Luna. El modelo de gama alta de OpenAI, GPT-6 Astra, había salido un poco antes, el 3 de septiembre.

Este artículo compara lo que se puede comparar con fuentes oficiales. Una precisión de entrada: la página de anuncio de OpenAI no pudo consultarse en el momento de la redacción (acceso denegado por el servidor). La información de OpenAI procede, por tanto, de su documentación para desarrolladores: el changelog y la página de precios.

Quién es quién en la gama GPT-6

OpenAI divide GPT-6 en tres modelos, siguiendo el esquema de GPT-5.6:

  • GPT-6 Astra (gpt-6-astra): presentado como «nuestro modelo más capaz, diseñado para el trabajo de principio a fin más difícil». Razonamiento, código, computer use, investigación y creación de documentos.
  • GPT-6 Sol (gpt-6-sol) y GPT-6 Luna (gpt-6-luna): modelos de razonamiento que aceptan texto e imágenes, disponibles en las API Responses y Chat Completions.

Para simplificar, Astra juega en la categoría de Opus 5.5 y Fable 5.1. Sol y Luna apuntan más bien al volumen, donde Anthropic sitúa a Sonnet y Haiku (Sonnet 5.5 y Haiku 5.5 están anunciados «en las próximas semanas»).

Las tarifas, lado a lado

Precios oficiales por millón de tokens, en procesamiento estándar. Para OpenAI, son las tarifas de «contexto corto», que se aplican hasta 272 000 tokens de entrada.

ModeloEntradaLectura de cachéEscritura de cachéSalida
Claude Opus 5.54 $0,20 $5 $20 $
GPT-6 Astra10 $1 $12,50 $50 $
GPT-6 Sol2 $0,20 $2,50 $10 $
GPT-6 Luna0,10 $0,01 $0,125 $0,50 $

Por encima de 272 000 tokens de entrada, OpenAI aplica una tarifa de «contexto largo» más alta: por ejemplo, 20 $ de entrada y 75 $ de salida para Astra. Si trabajas con repositorios grandes y mucho contexto, es un umbral a vigilar.

Sobre el papel, Opus 5.5 cuesta dos veces y media menos que Astra, token por token. GPT-6 Sol cuesta la mitad que Opus 5.5 en entrada y salida, con el mismo precio de lectura de caché.

Los benchmarks disponibles

La única tabla oficial que pone a Opus 5.5 y GPT-6 Astra lado a lado viene de Anthropic. Hay que leerla como lo que es: el punto de vista de uno de los dos competidores.

BenchmarkOpus 5.5GPT-6 Astra
Terminal-Bench 4.066,4 %57,9 %
FrontierCode v1.1 (Main)54,4 %53,3 %
GDPval-AA v2.1 (Elo)18461542
AutomationBench40,0 %41,4 %
Humanity's Last Exam (con herramientas)67,7 %57,2 %
Terminal-Bench-Science 0.158,7 %64,6 %

Lo que precisan las notas de la tabla:

  • Las puntuaciones de GPT-6 Astra en Terminal-Bench 4.0 y Terminal-Bench-Science son «las publicadas por OpenAI». Anthropic no las volvió a medir.
  • En Terminal-Bench 4.0, Opus 5.5 aparece con esfuerzo xhigh y Astra con esfuerzo high. Cada modelo se toma en su mejor puntuación.
  • Los resultados de AutomationBench proceden de Zapier. Las ejecuciones de Opus 5.5 se hicieron sin modelo de respaldo, así que cada intervención de las salvaguardas contaba como fallo.

Astra gana en AutomationBench y Terminal-Bench-Science. Opus 5.5 gana en el resto. Ninguno domina en todo.

Falta sobre todo una cosa: ninguna cifra compara Opus 5.5 con GPT-6 Sol, lanzado el mismo día. Los dos anuncios se publicaron en paralelo, y ninguna de las fuentes oficiales consultadas ofrece ese cara a cara. Desconfía de las tablas que ya circulan con esas dos columnas: comprueba de dónde salen las cifras.

Las diferencias técnicas que importan a un desarrollador

Más allá de las puntuaciones, algunas restricciones documentadas pueden pesar en la elección:

En GPT-6 Astra, el changelog de OpenAI enumera cambios a tener en cuenta en una migración: no hay nivel de razonamiento none, ni temperature o top_p personalizados, ni logprobs, y la llamada a herramientas exige la API Responses. OpenAI añade también una supervisión de alineamiento asíncrona que puede lanzar una alerta o detener una conversación para revisión.

En Opus 5.5, el modo «thinking» ya no se puede desactivar, y la mayoría de las tareas de ciberseguridad se redirigen a Opus 4.8.

Los dos fabricantes coinciden, pues, en un punto: el razonamiento pasa a ser obligatorio en sus modelos de gama alta.

Entonces, ¿cuál elegir?

Si usas Claude Code, la pregunta apenas se plantea: la herramienta funciona con los modelos de Anthropic, y Opus 5.5 es el modelo por defecto en la mayoría de los planes.

Si construyes tu propio producto sobre una API, esta es una lectura honesta:

  • Tareas de agente largas sobre código: las cifras publicadas favorecen a Opus 5.5, pero vienen de Anthropic. Prueba con tus propias tareas.
  • Gran volumen, tareas sencillas: GPT-6 Luna a 0,10 $ de entrada no tiene hoy equivalente publicado en Anthropic, ya que Haiku 5.5 aún no ha salido.
  • Investigación científica agéntica: Astra tiene la mejor puntuación publicada en Terminal-Bench-Science (64,6 %), según esa misma tabla de Anthropic.

El único método fiable sigue siendo el de julio: tomar diez tareas representativas de tu trabajo, ejecutarlas en cada modelo y medir el coste real y la calidad.

Próximos pasos