GPT-5.6 Luna price down 80%, Terra down 20% →

La oleada de modelos de julio de 2026: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3, etc.

CometAPI
AnnaAug 1, 2026
La oleada de modelos de julio de 2026: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3, etc.

TL;DR: Seis grandes lanzamientos de modelos llegaron con unas tres semanas de diferencia entre sí en julio de 2026: la familia de tres niveles GPT-5.6 de OpenAI (Sol/Terra/Luna), Gemini 3.6 Flash de Google, Grok 4.5 de xAI, Kimi K3 de Moonshot AI, Claude Opus 5 de Anthropic y GLM-5.2 de Zhipu. Ninguno es la mejor opción universal. La decisión práctica depende de la profundidad de razonamiento, el desempeño en programación, el coste por token, los requisitos de contexto y si importa el despliegue con pesos abiertos. Esta comparación usa información oficial actual de los proveedores y listados de CometAPI, con afirmaciones de benchmarks etiquetadas por fuente en lugar de tratarlas como un único ranking universal.

Puntos clave:

  • GPT-5.6 no es un único modelo: son tres (Sol, Terra, Luna) con tres niveles de precio distintos, y elegir el nivel equivocado es un error de coste mayor que equivocarse de familia de modelos por completo.
  • Gemini 3.6 Flash y GLM-5.2 publican una ventana de contexto de 1,000,000 tokens; Kimi K3 iguala esa cifra también — el tamaño de contexto ha dejado de ser un diferenciador entre los modelos líderes de esta generación.
  • GLM-5.2 y Kimi K3 admiten despliegue con pesos abiertos, pero no usan la misma licencia. GLM-5.2 se publica bajo la MIT License; Kimi K3 usa la Kimi K3 License, cuyos términos comerciales deben revisarse antes de autoalojar u ofrecer acceso de “model-as-a-service”.
  • Claude Opus 5 está oficialmente publicado. Anthropic lo anunció el 24 de julio de 2026 con una ventana de contexto de 1M tokens, hasta 128K de salida sincrónica y precios oficiales de $5 por millón de tokens de entrada y $25 por millón de tokens de salida; CometAPI actualmente lo lista a $4/$20.

Qué se publicó realmente este mes

Julio de 2026 fue un mes inusualmente denso para lanzamientos de modelos de frontera y casi frontera. En unas tres semanas, OpenAI lanzó la familia GPT-5.6 (9 de jul), xAI publicó Grok 4.5 (8 de jul), Moonshot AI lanzó Kimi K3 (16 de jul), Google lanzó Gemini 3.6 Flash (21 de jul) y Anthropic presentó oficialmente Claude Opus 5 (24 de jul). GLM-5.2 de Zhipu llegó un poco antes en junio, pero su contexto de 1M tokens y su publicación abierta bajo la MIT License lo hacen relevante para la misma decisión de compra y despliegue.

La pregunta práctica para cualquiera que construya sobre estos modelos no es cuál es el mejor en abstracto, sino cuál opción confirmada encaja con un trabajo específico. Los seis difieren significativamente en coste, contexto, comportamiento en programación, licenciamiento y flexibilidad de despliegue.

Comparativa de precios y especificaciones

Todos los precios a continuación son por millón de tokens. Cuando un modelo tiene varios niveles, cada uno se lista por separado.

ModelInputOutputContext WindowLicenseReleased
GPT-5.6 Sol$5.00$30.00Not publicly specifiedProprietaryJul 9, 2026
GPT-5.6 Terra$2.50$15.00Not publicly specifiedProprietaryJul 9, 2026
GPT-5.6 Luna$1.00$6.00Not publicly specifiedProprietaryJul 9, 2026
Grok 4.5$2.00$4.00Not publicly specifiedProprietaryJul 8, 2026
Kimi K3$3.00$15.001,048,576 tokensOpen weights (Kimi K3 License)Jul 16, 2026
Gemini 3.6 Flash$1.50$7.501,048,576 tokens (65,536 output)ProprietaryJul 21, 2026
GLM-5.2$1.40$4.411,000,000 tokensOpen (MIT license)Jun 13, 2026
Claude Opus 5$5.00$25.001,000,000 tokens (128K output)ProprietaryJul 24, 2026

*Las tarifas oficiales de los proveedores se muestran arriba; una API unificada que aplique un descuento estándar reduciría cada una de forma proporcional — el objetivo de la tabla es la diferencia relativa entre modelos, no el precio de pago de un proveedor específico.

Varias cosas destacan en la tabla de precios y especificaciones. Sol, el nivel superior de GPT-5.6, tiene un precio orientado a razonamiento de frontera y trabajo agentivo más que a uso cotidiano, mientras que el precio de salida de Grok 4.5 es comparativamente bajo para su posicionamiento. GLM-5.2 tiene el precio de salida más bajo en este grupo y usa la permisiva MIT License. Kimi K3 también ofrece pesos descargables y un contexto de 1M tokens, pero bajo la Kimi K3 License en lugar de MIT. Gemini 3.6 Flash, Kimi K3, GLM-5.2 y Claude Opus 5 publican ventanas de contexto de aproximadamente 1M tokens, así que la capacidad de contexto por sí sola ya no basta para elegir entre ellos. Las tarifas que lista CometAPI suelen ser inferiores a los precios de lista de los proveedores, pero la evaluación a nivel de carga de trabajo sigue siendo más útil que comparar precios por token de forma aislada.

Para qué está realmente ajustado cada uno

GPT-5.6 Sol está posicionado para razonamiento de frontera, programación agentiva y trabajo técnico de largo horizonte — admite un modo de “Max Reasoning Effort” y un “Ultra Mode” que despliega subagentes en paralelo. Este es el nivel al que acudir para problemas difíciles y multietapa, no para tareas rutinarias, dado el diferencial de precio frente a Terra y Luna.

GPT-5.6 Terra es el nivel intermedio equilibrado — productividad diaria, documentación, soporte a la programación y automatización de negocios. Para la mayoría de los backends de aplicaciones que no necesitan específicamente la profundidad de razonamiento de Sol, Terra es el valor por defecto más defendible.

GPT-5.6 Luna se orienta al uso ligero y de alto volumen: clasificación, flujos de soporte al cliente, onboarding, generación repetida de contenido. A $1.00/$6.00 por millón de tokens (antes de cualquier descuento de gateway), su precio está pensado exactamente para ese tipo de cargas de trabajo de alto volumen de llamadas y baja complejidad — y también admite precios con entrada en caché con un 90% de descuento sobre la tarifa estándar de entrada, lo cual importa más aquí que en los niveles superiores dada la naturaleza repetitiva de estas cargas.

Grok 4.5 no publica una especialización explícita como lo hacen los niveles de GPT-5.6, pero su precio lo sitúa entre una opción económica y una de nivel medio — merece una comparación directa de benchmarks frente a Terra o Kimi K3 para una carga de trabajo concreta, en lugar de asumir su posicionamiento solo por el precio.

Kimi K3 es un modelo Mixture-of-Experts de 2.8 billones de parámetros, diseñado para programación de largo horizonte, trabajo de conocimiento multimodal y análisis extenso de documentos o repositorios dentro de un contexto de 1M tokens. Moonshot AI ha publicado los pesos completos, por lo que el autoalojamiento es posible, pero la publicación usa la Kimi K3 License, que incluye condiciones comerciales que difieren de una publicación MIT estándar.

Gemini 3.6 Flash es la versión enfocada en eficiencia de Google: se presenta explícitamente como una continuación incremental optimizada en coste y latencia respecto a 3.5 Flash, más que como un nuevo modelo de frontera, con mejoras reales en programación y pruebas de referencia de agentes junto con un precio por token de salida inferior al de su predecesor. Es la elección para cargas de trabajo con agentes donde la eficiencia de tokens y el coste por tarea completada importan tanto como la capacidad bruta.

GLM-5.2 es la opción abierta con licencia más permisiva en esta comparación. Z.ai lo publicó bajo la MIT License con un contexto de 1M tokens y énfasis explícito en programación de largo horizonte, uso de herramientas y esfuerzo de razonamiento ajustable. Los equipos pueden acceder a él vía API o ejecutar los pesos publicados localmente, sujetos a su propia infraestructura y requisitos de evaluación.

Comparación de capacidad de programación

Los seis lanzamientos se orientan a patrones de ingeniería diferentes, por lo que la capacidad en programación se entiende mejor como ajuste a carga de trabajo que como un único ranking.

  • Claude Opus 5 es el encaje más sólido para depuración difícil, análisis de causa raíz, refactorizaciones grandes y agentes de software de larga ejecución; Anthropic destaca un comportamiento de verificación e iteración más fuerte.
  • GPT-5.6 Sol, Terra y Luna ofrecen una ruta escalonada desde programación y razonamiento complejos hasta trabajo de desarrollo equilibrado y asistencia de código de alto volumen.
  • Gemini 3.6 Flash está ajustado para bucles rápidos de programación con agentes donde importan la latencia y el coste por iteración.
  • Kimi K3 está diseñado para programación de largo horizonte sobre repositorios muy grandes, con un contexto de 1M tokens y pesos descargables.
  • GLM-5.2 combina programación de largo horizonte, uso de herramientas, esfuerzo de razonamiento ajustable y despliegue local bajo la MIT License.
  • Grok 4.5 conviene tratarlo como candidato a evaluación directa frente a los demás, porque su posicionamiento oficial no proporciona el mismo desglose de especialización en programación que la familia GPT escalonada.

La contrapartida de comparar (y alternar) modelos con esta frecuencia

Nada de esto es un argumento para perseguir cada nuevo lanzamiento. Cambiar cargas de trabajo en producción a un modelo nuevo cada vez que aparece uno conlleva costes reales: volver a probar prompts, revalidar la calidad de salida y volver a comprobar el coste por tarea frente a tu tráfico real, no el sintético de un benchmark. Una API unificada no elimina ese trabajo de evaluación, pero sí elimina la sobrecarga de cuentas y facturación separadas a la hora de ejecutar la comparación — poder llamar a GPT-5.6 Terra, Gemini 3.6 Flash, Kimi K3 y GLM-5.2 con la misma forma de solicitud y una sola factura hace realista probar más de un candidato antes de comprometerse, en lugar de quedarse por defecto con el proveedor para el que ya tenías una clave.

Eso es una ventaja genuina, no una solución completa — no sustituye leer la documentación real de cada modelo, y no elimina los costes de cambio descritos arriba. Lo que hace es reducir el coste de descubrir cuál modelo es realmente el adecuado para una carga de trabajo dada, que es una afirmación diferente (y más honesta) que “este modelo es el mejor”.

Preguntas frecuentes

¿Cuál es el mejor modelo de IA publicado en julio de 2026? No hay una única mejor respuesta. GPT-5.6 Sol y Claude Opus 5 apuntan a trabajo exigente de razonamiento y programación; Gemini 3.6 Flash enfatiza bucles eficientes con agentes; Kimi K3 combina contexto largo con pesos abiertos; y GLM-5.2 combina capacidad de largo horizonte con una MIT License. La elección correcta depende de la carga de trabajo y las restricciones de despliegue.

¿GPT-5.6 es un modelo o varios? Tres: Sol (insignia, razonamiento de frontera), Terra (equilibrado, uso diario) y Luna (rápido y de bajo coste, tareas de alto volumen) — cada uno con precio por separado, desde $0.80/$4.80 por millón de tokens para Luna hasta $4.00/$24.00 para Sol.

¿Claude Opus 5 está oficialmente publicado? Sí. Anthropic anunció Claude Opus 5 el 24 de julio de 2026. La publicación oficial describe una ventana de contexto de 1M tokens y posiciona el modelo para programación agentiva compleja y trabajo de conocimiento; el precio oficial de API es de $5 por millón de tokens de entrada y $25 por millón de tokens de salida.

¿Cuál de estos modelos es más barato de ejecutar a escala? En los precios de salida listados por los proveedores en la tabla, GLM-5.2 es la opción de menor coste y está disponible bajo la MIT License. Kimi K3 también tiene pesos abiertos, pero su Kimi K3 License separada y una huella de modelo mucho mayor cambian la economía del autoalojamiento. GPT-5.6 Luna es la opción propietaria más barata, solo por API, cubierta aquí.

¿Necesito elegir un modelo y comprometerme, o puedo probar varios? Probar más de uno con tus prompts y tráfico reales suele justificar el coste de configuración antes de comprometer tráfico de producción — una API unificada (CometAPI, entre otras) reduce específicamente ese coste al eliminar la sobrecarga de cuentas separadas para ejecutar la comparación, aunque no sustituye leer la documentación de cada modelo.

Conclusión

La oleada de lanzamientos de julio de 2026 no produjo un ganador claro. Produjo seis opciones confirmadas que se compensan de manera diferente en profundidad de razonamiento, rendimiento en programación, coste por token, contexto y licenciamiento. GPT-5.6 Sol y Claude Opus 5 apuntan al trabajo más difícil de razonamiento e ingeniería de software; Gemini 3.6 Flash y GPT-5.6 Luna enfatizan la eficiencia; Kimi K3 aporta pesos abiertos y un contexto multimodal de 1M bajo su propia licencia; y GLM-5.2 ofrece una alternativa de 1M tokens con MIT License. Todos son accesibles a través de CometAPI bajo una sola clave, lo que facilita pruebas controladas, pero la selección de modelo debe seguir basándose en los prompts, herramientas, objetivos de latencia y criterios de éxito de la carga de trabajo real.

¿Listo para reducir los costos de desarrollo de IA en un 20%?

Comienza gratis en minutos. Créditos de prueba gratuitos incluidos. No se requiere tarjeta de crédito.

Leer Más