GPT-6 Astra is now live on CometAPI →
technology/Investigación de CometAPI

Radar de lanzamientos de modelos de IA de agosto de 2026: novedades en CometAPI

Review 15 AI models CometAPI added in August 2026, verified via official Changelog: priority picks, exact model IDs, native/compatible endpoints, pricing.

CometAPI
Bobby SpencerEquipo de investigación de modelos de IA y API
Actualizado Sep 4, 2026 10 min de lectura
Radar de lanzamientos de modelos de IA de agosto de 2026: novedades en CometAPI
Usa este patrón

Haz la primera llamada a la API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR: El Changelog de CometAPI registra 15 nuevos ID de modelo en agosto de 2026 en cargas de trabajo de texto, multimodal, imagen y video. Empiece con Seedance 2.5 o Wan3.0 para video, GLM 5.3 Flash para trabajo multimodal sensible al costo y Gemini 3.7 Flash para programación y tareas de contexto largo; luego verifique la página del modelo en vivo, el endpoint y el precio antes del despliegue.

¿Qué nuevos modelos de IA añadió CometAPI en agosto de 2026?

El resumen de modelos de agosto de 2026 de CometAPI es útil porque cada modelo está disponible con una sola clave de API y un único flujo de facturación, con ID de catálogo estables, endpoints documentados y precios por modelo. Los desarrolladores pueden cambiar un ID de modelo sin reconstruir toda la integración, utilizando el formato de solicitud nativo o compatible que mejor se adapte a cada proveedor.

A fecha del 1 de septiembre de 2026, el Changelog oficial de CometAPI es la fuente para la cronología de lanzamientos de agosto y registra 15 nuevos ID de modelo en razonamiento de texto, comprensión visual, generación de imágenes y video. El Catálogo de modelos y las páginas de cada modelo siguen siendo la fuente de disponibilidad y precios actuales. Los modelos prioritarios para probar primero son Seedance 2.5 para video multimodal, Wan3.0 para flujos de trabajo de video en producción, GLM 5.3 Flash para razonamiento multimodal sensible al costo y Gemini 3.7 Flash para codificación y trabajo de contexto largo.

Resumen de lanzamientos de modelos de CometAPI en agosto de 2026

Model / IDModalityCurrent CometAPI Price (as of Sep 3, 2026)Recommended Endpoint
Gemini 3.7 Flash
gemini-3.7-flash
Multimodal → texto$0.60 entrada / $3.00 salida por 1M tokensPOST /v1beta/models/{model}:generateContent
Grok 4.6
grok-4.6
Texto, imagen → texto$1.60 entrada / $4.80 salida por 1M tokensPOST /v1/chat/completions
POST /v1/responses
GLM 5.3
glm-5.3
Texto → texto$1.12 entrada / $3.528 salida por 1M tokensPOST /v1/chat/completions
DeepSeek V4 Flash Vision
deepseek-v4-flash-vision
Texto, imagen → texto$0.352 entrada / $1.056 salida por 1M tokensPOST /v1/chat/completions
Grok Imagine Image 2.0
grok-imagine-image-2.0
Texto, imagen → imagen$0.032 por solicitudPOST /v1/images/generations
GLM 5.3 Flash
glm-5.3-flash
Texto, imagen, video → texto$0.06 entrada / $0.20 salida por 1M tokensPOST /v1/chat/completions
Seedance 2.5
seedance-2-5
Multimodal → videoDesde $0.0824/s; facturación detallada: $0.103/s (480p), $0.231/s (720p)POST /v1/videos
Qwen3.8 Max
qwen3.8-max
Multimodal → texto$1.60 entrada / $4.80 salida por 1M tokensPOST /v1/chat/completions
POST /v1/responses
MiniMax H3
minimax-h3
Texto, imagen, video, audio → videoDesde $0.064/s; tarifas listadas: $0.08/s (768p), $0.13/s (2K)POST /v1/videos
GET /v1/videos/{task_id}
DeepSeek V4 Pro 0813
deepseek-v4-pro-0813
Texto → texto$0.528 entrada / $1.584 salida / $0.0176 lectura de caché por 1M tokens; 2× en las ventanas UTC indicadasPOST /v1/chat/completions
FLUX 3
flux-3
Multimodal → video$0.136/s (720p); $0.232/s (1080p)POST /v1/videos
GET /v1/videos/{task_id}
Qwen3.8 2.4T A95B
qwen3.8-2.4t-a95b
Texto → texto$1.60 entrada / $4.80 salida por 1M tokensPOST /v1/chat/completions
Grok Imagine Video 1.5
grok-imagine-video-1.5
Texto, imagen → videoEntrada de imagen $0.008; salida $0.064/s (480p), $0.112/s (720p), $0.20/s (1080p)POST /grok/v1/videos/generations
GET /grok/v1/videos/{request_id}
Wan3.0
wan3.0
Texto, imagen → videoDesde $0.04/s; tarifas listadas: $0.05/s (480p), $0.10/s (720p), $0.20/s (1080p)POST /v1/videos
Qwen3.8 Flash
qwen3.8-flash
Multimodal → texto$0.12 entrada / $0.376001 salida por 1M tokensPOST /v1/chat/completions

Esta tabla destaca los modelos prioritarios entre las 15 incorporaciones registradas en el Changelog de agosto de CometAPI, incluidos los precios con descuento por tiempo limitado cuando CometAPI lo indica. Dado que las afirmaciones de benchmarks provienen de distintos proveedores y fechas de lanzamiento, use el catálogo para descubrimiento y planificación de integración en lugar de un marcador universal de comparativas directas.

Actualizaciones solo de precios para gpt-5.6-sol y minimax-m3, además de ajustes de servicio para modelos DeepSeek existentes, no se cuentan como lanzamientos nuevos.

4 modelos de agosto que recomiendo

El catálogo de agosto es amplio, pero cuatro modelos destacan para diferentes cargas de trabajo. Las recomendaciones a continuación se centran en el ajuste práctico en lugar de repetir la tabla de precios; confirme la tarifa en vivo y el formato de solicitud en la página de cada modelo antes del uso en producción.

Seedance 2.5: Video multimodal más largo

Dado que la tarificación de video se factura por segundo y varía según la resolución, conserve la fecha de referencia y enlace a la página del modelo en vivo. Para Seedance 2.5, un clip 480p cuesta $0.103 por segundo mientras que un clip 720p cuesta $0.231 por segundo—más del doble—de modo que presupueste según la resolución que su carga de trabajo realmente use.

Wan3.0: Video de producción con menor costo de entrada

Wan3.0 ya está disponible para flujos de trabajo de texto a video e imagen a video. Es una opción práctica cuando los equipos necesitan un endpoint asíncrono de producción, facturación predecible por segundo y margen para comparar velocidad, calidad de movimiento y resolución frente a otros modelos de video.

GLM 5.3 Flash: Razonamiento multimodal de bajo costo

GLM 5.3 Flash es la elección enfocada en costos para alto volumen de comprensión de texto e imágenes. Pruébelo para extracción, preguntas y respuestas visuales, asistencia de codificación y pasos de agentes donde la latencia y el costo importan más que el rendimiento máximo en benchmarks.

Kimi K3: Codificación de contexto largo y trabajo de conocimiento

Kimi K3 se lanzó en julio pero siguió siendo uno de los modelos más relevantes para adoptar durante agosto. Su ventana de contexto de un millón de tokens y la ruta de chat compatible con OpenAI lo hacen útil para repositorios grandes, síntesis de investigación y flujos de trabajo de codificación de larga duración.

¿Qué nuevo modelo de IA debería usar según el caso de uso?

Gemini 3.7 Flash: Trabajo de codificación y contexto largo

Las señales publicadas enfatizan la ingeniería de software y el trabajo de conocimiento, pero la prueba útil de producción es su propio repositorio o conjunto de documentos. Ejecute un conjunto fijo de prompts, registre la tasa de tareas aceptadas, la latencia y los tokens facturados, luego compare el resultado con el modelo que ya utiliza.

Modelos de video: Movimiento, fidelidad a la referencia y costo por clip aceptado

Para Seedance 2.5, Wan3.0 y MiniMax H3, use el mismo prompt, duración, relación de aspecto e imagen de referencia. Puntúe consistencia del movimiento, adhesión al prompt, artefactos visuales, tiempo de generación y costo por clip que pase la revisión.

Modelos multimodales: Precisión antes que el máximo contexto

Para GLM 5.3 Flash, DeepSeek V4 Flash Vision y Gemini 3.7 Flash, pruebe capturas de pantalla, gráficos, PDF e insumos mixtos de texto e imagen. Una ventana de contexto grande importa solo cuando el modelo recupera la evidencia correcta y produce una respuesta estable.

DeepSeek V4 Flash Vision: Úselo para agentes de codificación visual, análisis de gráficos, capturas de pantalla y entradas de automatización de navegador. Evalúelo en sus propias tareas mixtas de texto e imagen y compare precisión, latencia y tokens facturados antes de adoptarlo en producción.

Grok Imagine Image 2.0: Úselo para canalizaciones de generación más edición, múltiples relaciones de aspecto, creatividades de producto e iteración basada en referencias. Presupueste desde la calidad y resolución que su carga de trabajo requiera, no solo el precio inicial más bajo.

Próximamente en CometAPI: Lista de seguimiento

A fecha del 3 de septiembre de 2026, esta lista de seguimiento incluye solo modelos cuyas páginas de CometAPI están marcadas como Coming Soon. Trate sus ID de modelo, rutas y precios como provisionales hasta que el catálogo confirme acceso a producción en vivo.

ModelModel IDStatusDecision
Qwen-Image-3.0qwen-image-3.0Coming SoonEn observación; no planificar tráfico de producción todavía.
Veo 4veo4Coming SoonEspere a una ruta en vivo confirmada y facturación antes de usar en producción.

¿Cómo llamar APIs nativas y compatibles con OpenAI en CometAPI?

CometAPI usa una sola clave de API y un flujo de facturación, pero no obliga a todos los proveedores a un mismo formato de solicitud. Use la página del modelo para elegir la ruta más adecuada: generación de contenido nativa de Gemini para Gemini, chat compatible con OpenAI para muchos LLM, endpoints de imagen para modelos de imagen y la API asíncrona de video para modelos de video. Los breves ejemplos POST a continuación muestran solo la ruta y el campo model; consulte la documentación del API para ver los parámetros completos.

La ruta POST cambia con la modalidad. Gemini admite la ruta nativa /v1beta/models/{model}:generateContent así como patrones compatibles; Grok Imagine Image 2.0 usa /v1/images/generations; y Seedance 2.5 usa /v1/videos, seguido de sondeo del estado de la tarea. Utilice la API de Texto, la API de Imagen y la API de Video como fuente de la verdad.

Preguntas frecuentes

¿Cuáles son los mejores agregadores de API de IA para desarrolladores?

La mejor elección depende de si necesita solo LLM de texto o un stack más amplio de texto, imagen, audio y video. Evalúe cada agregador por ID de modelo en vivo, compatibilidad de endpoints, visibilidad de uso, soporte de respaldo, transparencia de facturación y actualización del catálogo. CometAPI merece estar en la lista corta cuando una sola clave y un flujo de facturación único a través de múltiples modalidades son prioridades.

¿Qué modelos de agosto de 2026 están realmente en vivo en CometAPI?

A fecha del 1 de septiembre, el Changelog de agosto registra 15 nuevos ID de modelo. La lista completa, formatos compatibles y notas de precios se resumen en la tabla anterior. Vuelva a comprobar el Catálogo de modelos antes del despliegue porque la disponibilidad, alias y precios pueden cambiar.

¿Puedo cambiar de proveedor sin cambiar todo mi SDK?

A menudo, pero no siempre. Muchos modelos de texto admiten /v1/chat/completions, mientras que Gemini también puede usar su ruta nativa de generación de contenido y los modelos de medios usan endpoints de imagen, tiempo real o video. CometAPI mantiene una sola clave y flujo de facturación en estos formatos, por lo que cambiar de proveedor es más sencillo incluso cuando el cuerpo de la solicitud no es idéntico.

¿Cómo funciona la generación de video?

La generación de video es asíncrona. Cree la tarea, conserve el ID de tarea devuelto y luego sondee o reciba un webhook hasta que la tarea tenga éxito o falle. Solo tras completarse la tarea la aplicación debe recuperar y almacenar el resultado.

¿Con qué frecuencia debo volver a comprobar los ID de modelo y los precios?

Verifique antes de la integración, antes de un lanzamiento a producción y antes de cualquier lote grande. Los sistemas automatizados también deberían registrar el ID de modelo exacto y la instantánea de precio utilizada para cada estimación de costos, de modo que los cambios posteriores del catálogo no reescriban el historial de una decisión de despliegue.

Conclusión

Las 15 incorporaciones de agosto en CometAPI amplían opciones prácticas en codificación, visión, imagen y video manteniendo una sola clave y un único flujo de facturación. Empiece con Seedance 2.5, Wan3.0, GLM 5.3 Flash o Gemini 3.7 Flash según la carga de trabajo, luego promocione un modelo solo después de que pruebas con prompts fijos midan calidad, latencia, confiabilidad y costo facturado.

Seguir aprendiendo

Conecta este artículo con la siguiente decisión.

Ver todos los temas
Publicado el Sep 3, 2026
Última actualización Sep 4, 2026
2 visitas
Revisado para mayor claridad, atribución de fuentes y terminología API actual.

¿Listo para reducir los costos de desarrollo de IA en un 20%?

Comienza gratis en minutos. Créditos de prueba gratuitos incluidos. No se requiere tarjeta de crédito.

Leer Más