OpenAI y Anthropic lanzaron nuevos modelos el 22 de septiembre, pero sus catálogos avanzan a ritmos distintos. GPT-6 Sol y Luna se suman a Astra, mientras que Terra sigue en GPT-5.6. Claude Opus avanza a la versión 5.5, junto con Fable 5.1, Sonnet 5 y Haiku 4.5, que tiene casi un año.

Las comparaciones relevantes son Astra frente a Fable, Sol frente a Opus, Terra frente a Sonnet y Luna frente a Haiku. Al observar los cuatro pares se ve una competencia más interesante que la de cualquiera de los lanzamientos por separado: Opus desafía al nivel insignia, Luna presiona la oferta económica de Anthropic y la zona intermedia de ambas gamas sigue sin renovarse por completo.

El cambio de fondo

  • Qué ha cambiado: Ahora los compradores pueden obtener modelos más recientes a precios muy distintos dentro de la gama de un mismo proveedor. OpenAI ha renovado su nivel económico, mientras que Anthropic ha centrado este lanzamiento en Opus y ha dejado a Haiku casi un año atrás en el calendario de versiones.
  • Por qué importa: Los equipos de producto tienen más margen para reducir el coste del uso rutinario de IA y pagar por mejores resultados cuando los errores salen caros. La dificultad está en elegir según el rendimiento demostrado: la posición de un modelo en la gama no permite predecir de forma fiable sus resultados en pruebas comparativas.
  • Qué conviene observar: Anthropic afirma que Sonnet 5.5 y Haiku 5.5 llegarán en las próximas semanas. Sus precios y resultados determinarán cuánto dura la oportunidad actual de OpenAI, sobre todo en productos que realizan muchas llamadas económicas.

Precios por nivel

Todas las cifras siguientes son dólares estadounidenses estándar por millón de tokens de API directa, consultadas el 22 de septiembre. La entrada en caché corresponde a un acierto de caché. Las tarifas publicadas por OpenAI se aplican hasta 272.000 tokens de entrada; por encima de ese límite, se duplican las tarifas de entrada para la solicitud completa y las de salida aumentan un 50 %. Las escrituras en caché, el procesamiento por lotes y las herramientas tienen condiciones de facturación propias. Fuentes: OpenAI y Anthropic.

Modelo

Entrada

Entrada en caché

Salida

GPT-6 Astra

$10

$1

$50

Claude Fable 5.1

$10

$0,25

$50

GPT-6 Sol

$2

$0,20

$10

Claude Opus 5.5

$4

$0,20

$20

GPT-5.6 Terra

$2

$0,20

$12

Claude Sonnet 5

$2

$0,20

$10

GPT-6 Luna

$0,10

$0,01

$0,50

Claude Haiku 4.5

$1

$0,10

$5

Inteligencia y gasto medido en pruebas

Artificial Analysis Intelligence Index v4.3.2, consultado el 22 de septiembre. Los costes son el gasto medio ponderado del operador por tarea del índice.

Modelo

Configuración probada

Índice de inteligencia

Coste por tarea del índice

GPT-6 Astra

Max

52,7

$3,26

Claude Fable 5.1

Max con configuración de respaldo

53,4

$7,63

GPT-6 Sol

Max

47,5

No publicado

Claude Opus 5.5

Max con configuración de respaldo

57,6

$5,98

GPT-5.6 Terra

Max

42,1

$1,40

Claude Sonnet 5

Max

38,2

$5,09

GPT-6 Luna

Max

37,3

No publicado

Claude Haiku 4.5

Razonamiento activado

16,9

$0,21

Fuente: Artificial Analysis; más abajo se enlazan los resultados de cada modelo.

Astra frente a Fable: el dúo insignia

Sus precios estándar de entrada y salida coinciden. La tarifa de Fable por aciertos de caché es una cuarta parte de la de Astra, una diferencia relevante cuando las aplicaciones reutilizan repetidamente contenido apto de las instrucciones.

En el índice de inteligencia actual de Artificial Analysis, Astra con el esfuerzo Max obtiene 52,7 y Fable 5.1 con Max y configuración de respaldo obtiene 53,4. Esa es una puntuación ajustada. Artificial Analysis informa de un gasto ponderado de 3,26 dólares por tarea del índice para Astra, frente a 7,63 dólares para Fable. Astra obtiene una puntuación similar con un gasto medido aproximadamente un 57 % menor, pese a que sus tarifas de entrada y salida son iguales. Resultados de Astra, resultados de Fable.

Sol frente a Opus: precios más bajos y puntuaciones más altas

Las tarifas normales de entrada y salida de Sol equivalen a la mitad de las de Opus; sus tarifas por aciertos de caché coinciden. OpenAI también redujo a la mitad los precios de entrada y salida de Sol frente a las tarifas de lanzamiento de GPT-5.6 Sol. Anthropic recortó un 20 % las tarifas correspondientes de Opus frente a Opus 5. Lanzamiento de OpenAI, lanzamiento de Opus.

Artificial Analysis puntúa a Sol con el esfuerzo Max en 47,5, frente a 57,6 para Opus 5.5 con Max y configuración de respaldo. Opus aventaja a Sol por 10,1 puntos y cobra el doble por la entrada y salida normales. También supera a Astra con tarifas de entrada y salida un 60 % menores. El gasto real en las pruebas cambia esa perspectiva: Opus promedia 5,98 dólares por tarea del índice, alrededor de un 84 % más que Astra. Al consultar los datos, el gráfico de costes publicado por Artificial Analysis aún no mostraba la cifra de Sol. Resultados de Sol, resultados de Opus.

Terra frente a Sonnet: falta el modelo GPT-6

OpenAI no incluye ningún GPT-6 Terra en su lanzamiento actual ni en el catálogo de modelos. La comparación disponible es GPT-5.6 Terra, cuyas tarifas actuales de API confirman los precios anteriores. La guía de Work y Codex de OpenAI también indica que los modelos 5.6 anteriores seguirán disponibles durante el despliegue.

Con el esfuerzo Max, Terra obtiene 42,1 en el índice de Artificial Analysis y Sonnet 5 obtiene 38,2. Terra también promedia 1,40 dólares por tarea del índice, frente a 5,09 dólares para Sonnet: una puntuación más alta con un gasto medido alrededor de un 73 % menor. Su tarifa por token de salida es un 20 % más alta, lo que muestra cómo el consumo de tokens y la caché pueden pesar más que el precio de lista. Resultados de Terra, resultados de Sonnet.

Sonnet 5 llegó el 30 de junio. Anthropic ya ha anunciado Sonnet 5.5 para las próximas semanas. La sucesora prometida deja intacta la comparación actual con Sonnet 5 hasta que la nueva versión esté disponible para probarla y conocer su precio.

Luna frente a Haiku: la mayor diferencia en antigüedad de lanzamiento

Luna cuesta una décima parte en cada categoría de tokens indicada. Haiku 4.5 se lanzó el 15 de octubre de 2025: 342 días antes que Luna. Sigue siendo el Haiku más reciente de Anthropic que ya se ha lanzado; la versión 5.5 está prevista para las próximas semanas.

Las pruebas independientes también muestran una brecha de rendimiento. Artificial Analysis puntúa a Luna con el esfuerzo Max en 37,3, frente a 16,9 para Haiku 4.5 con el razonamiento activado. Son puntos del índice en la misma batería de pruebas actual; Luna tiene además un precio por token un 90 % menor. Haiku con razonamiento promedia 0,21 dólares por tarea del índice; el coste correspondiente de Luna aún no figuraba en el gráfico publicado por el operador. Resultados de Luna, resultados de Haiku con razonamiento.

Para Anthropic, esta es una parte vulnerable de su gama: su modelo actual más barato se enfrenta a un competidor recién lanzado con tarifas por token aún menores y un resultado mucho más alto en esa evaluación. Por eso, la actualización anunciada de Haiku es uno de los próximos lanzamientos importantes para los desarrolladores que compran a gran escala.

Las cifras anteriores de Artificial Analysis corresponden a Intelligence Index v4.3.2, un agregado de diez evaluaciones consultado el 22 de septiembre. La configuración se indica junto a cada puntuación; los resultados de Fable y Opus incluyen la configuración de respaldo del operador. Índice y metodología.

¿Qué ocurre cuando los agentes tienen que completar el trabajo?

La prueba AutomationBench v1.0.6 de Zapier evalúa tareas completas en aplicaciones empresariales simuladas. Para aprobar, todos los resultados evaluados deben ser correctos. La clasificación del 22 de septiembre indica:

Modelo

Configuración probada

Tasa de éxito

Coste por tarea

GPT-6 Astra

Max

41,4 %

$1,73

Claude Fable 5.1

Max, sin respaldo

22,37 %

$2,45

GPT-6 Sol

Xhigh

33,2 %

$0,27

GPT-6 Sol

Max

32,0 %

$0,34

Claude Opus 5.5

Max

40,0 %

$1,28

GPT-5.6 Terra

Max

23,59 %

$0,51

Claude Sonnet 5

Max

10,65 %

$0,88

GPT-6 Luna

Max

20,7 %

$0,04

Claude Haiku 4.5

No especificada

0,46 %

$0,07

La configuración separada con Fable y Opus 5 obtiene un 31,4 %. Opus se encarga de aproximadamente el 40 % de sus tareas; los 2,45 dólares indicados no incluyen los tokens de la alternativa de respaldo.

Con el esfuerzo Xhigh, Sol gasta aproximadamente un 79 % menos por intento que Opus con Max, aunque su tasa de éxito es 6,8 puntos porcentuales menor. Luna supera a Haiku con un coste por tarea un 43 % menor. Astra lidera este grupo; ninguna tasa de éxito alcanza la mitad. Resultados y método de puntuación de Zapier.

Un calendario de lanzamientos activo y desigual

Los registros de versiones de API de ambas empresas permiten construir dos series seleccionadas. La lista de OpenAI sigue las versiones numeradas de GPT hasta GPT-6 Astra. Excluye las ramas especializadas Instant y Codex, y ampliaciones posteriores por niveles, como GPT-5.4 mini y nano el 17 de marzo, y GPT-6 Sol y Luna el 22 de septiembre. La lista de Anthropic sigue las versiones públicas de Opus en la API. El «intervalo» indica los días naturales desde la entrada anterior de la serie seleccionada de cada empresa.

  • Familia GPT-5 — 7 de agosto de 2025: lanzamiento de la familia; el intervalo no se aplica a la primera entrada.
  • GPT-5.1 — 13 de noviembre de 2025: actualización de versión; intervalo de 98 días.
  • GPT-5.2 — 11 de diciembre de 2025: actualización de versión; intervalo de 28 días.
  • GPT-5.4 — 5 de marzo de 2026: actualización de versión; intervalo de 84 días.
  • GPT-5.5 — 24 de abril de 2026: actualización de versión; intervalo de 50 días.
  • GPT-5.6 — 9 de julio de 2026: actualización de la familia con varios niveles; intervalo de 76 días.
  • GPT-6 Astra — 3 de septiembre de 2026: lanzamiento de una nueva familia; intervalo de 56 días.

Fuente: registro de cambios de la API de OpenAI. Por separado, GPT-6 Sol y Luna llegaron el 22 de septiembre, 19 días después de Astra. Ese intervalo mide una ampliación de niveles dentro de la misma familia y queda fuera de la serie de versiones numeradas anterior.

  • Opus 4 — 22 de mayo de 2025: versión principal; el intervalo no se aplica a la primera entrada.
  • Opus 4.1 — 5 de agosto de 2025: actualización menor; intervalo de 75 días.
  • Opus 4.5 — 24 de noviembre de 2025: actualización de versión; intervalo de 111 días.
  • Opus 4.6 — 5 de febrero de 2026: actualización de versión; intervalo de 73 días.
  • Opus 4.7 — 16 de abril de 2026: actualización de versión; intervalo de 70 días.
  • Opus 4.8 — 28 de mayo de 2026: actualización de versión; intervalo de 42 días.
  • Opus 5 — 24 de julio de 2026: versión principal; intervalo de 57 días.
  • Opus 5.5 — 22 de septiembre de 2026: actualización de versión y reducción de precio; intervalo de 60 días.

Fuente: notas de lanzamiento de la API de Anthropic. Fable y las versiones restringidas de Mythos son ramas independientes, así que no se incluyen en la secuencia de Opus.

Los intervalos entre las versiones numeradas de OpenAI oscilan entre 28 y 98 días; los de Opus de Anthropic, entre 42 y 111 días. Si se considera «lanzamiento principal» un cambio de número de familia, GPT-5 a GPT-6 tardó 392 días y Opus 4 a Opus 5, 428 días. Los intervalos más breves corresponden a actualizaciones menores y ampliaciones de niveles. Ambas series fluctúan: a intervalos más cortos les siguen otros más largos.

La presión práctica está en actualizar de forma selectiva

El calendario de lanzamientos da motivos constantes para reconsiderar qué modelo conviene usar. Los cuatro pares actuales muestran por qué un veredicto general sobre un proveedor no deja ver diferencias útiles: Anthropic tiene un Opus nuevo y potente, OpenAI acaba de presentar un nivel económico más competitivo y ambas empresas aún mantienen modelos más antiguos en partes de sus gamas.

Cambiar de versión también exige trabajo de ingeniería. La guía de migración a Opus 5.5 de Anthropic indica que el razonamiento está siempre activado, que forzar la selección de herramientas provoca un error y que la API de Claude y Google Cloud rechazan el tipo anterior de herramienta de uso del ordenador. Las integraciones existentes que usan esas opciones requieren cambios.

El próximo cambio anunciado es la renovación de Sonnet y Haiku de Anthropic. Eso da a los compradores un motivo concreto para volver a evaluar pronto los niveles inferiores. Por ahora, las listas de precios y los resultados independientes ya muestran dónde ha cambiado la competencia y dónde aún vale la pena considerar un modelo más antiguo.