TL;DR: El Changelog de CometAPI registra 15 nuevos ID de modelo en agosto de 2026 en cargas de trabajo de texto, multimodal, imagen y video. Empiece con Seedance 2.5 o Wan3.0 para video, GLM 5.3 Flash para trabajo multimodal sensible al costo y Gemini 3.7 Flash para programación y tareas de contexto largo; luego verifique la página del modelo en vivo, el endpoint y el precio antes del despliegue.
¿Qué nuevos modelos de IA añadió CometAPI en agosto de 2026?
El resumen de modelos de agosto de 2026 de CometAPI es útil porque cada modelo está disponible con una sola clave de API y un único flujo de facturación, con ID de catálogo estables, endpoints documentados y precios por modelo. Los desarrolladores pueden cambiar un ID de modelo sin reconstruir toda la integración, utilizando el formato de solicitud nativo o compatible que mejor se adapte a cada proveedor.
A fecha del 1 de septiembre de 2026, el Changelog oficial de CometAPI es la fuente para la cronología de lanzamientos de agosto y registra 15 nuevos ID de modelo en razonamiento de texto, comprensión visual, generación de imágenes y video. El Catálogo de modelos y las páginas de cada modelo siguen siendo la fuente de disponibilidad y precios actuales. Los modelos prioritarios para probar primero son Seedance 2.5 para video multimodal, Wan3.0 para flujos de trabajo de video en producción, GLM 5.3 Flash para razonamiento multimodal sensible al costo y Gemini 3.7 Flash para codificación y trabajo de contexto largo.
Resumen de lanzamientos de modelos de CometAPI en agosto de 2026
| Model / ID | Modality | Current CometAPI Price (as of Sep 3, 2026) | Recommended Endpoint |
|---|---|---|---|
| Gemini 3.7 Flash gemini-3.7-flash | Multimodal → texto | $0.60 entrada / $3.00 salida por 1M tokens | POST /v1beta/models/{model}:generateContent |
| Grok 4.6 grok-4.6 | Texto, imagen → texto | $1.60 entrada / $4.80 salida por 1M tokens | POST /v1/chat/completions POST /v1/responses |
| GLM 5.3 glm-5.3 | Texto → texto | $1.12 entrada / $3.528 salida por 1M tokens | POST /v1/chat/completions |
| DeepSeek V4 Flash Vision deepseek-v4-flash-vision | Texto, imagen → texto | $0.352 entrada / $1.056 salida por 1M tokens | POST /v1/chat/completions |
| Grok Imagine Image 2.0 grok-imagine-image-2.0 | Texto, imagen → imagen | $0.032 por solicitud | POST /v1/images/generations |
| GLM 5.3 Flash glm-5.3-flash | Texto, imagen, video → texto | $0.06 entrada / $0.20 salida por 1M tokens | POST /v1/chat/completions |
| Seedance 2.5 seedance-2-5 | Multimodal → video | Desde $0.0824/s; facturación detallada: $0.103/s (480p), $0.231/s (720p) | POST /v1/videos |
| Qwen3.8 Max qwen3.8-max | Multimodal → texto | $1.60 entrada / $4.80 salida por 1M tokens | POST /v1/chat/completions POST /v1/responses |
| MiniMax H3 minimax-h3 | Texto, imagen, video, audio → video | Desde $0.064/s; tarifas listadas: $0.08/s (768p), $0.13/s (2K) | POST /v1/videos GET /v1/videos/{task_id} |
| DeepSeek V4 Pro 0813 deepseek-v4-pro-0813 | Texto → texto | $0.528 entrada / $1.584 salida / $0.0176 lectura de caché por 1M tokens; 2× en las ventanas UTC indicadas | POST /v1/chat/completions |
| FLUX 3 flux-3 | Multimodal → video | $0.136/s (720p); $0.232/s (1080p) | POST /v1/videos GET /v1/videos/{task_id} |
| Qwen3.8 2.4T A95B qwen3.8-2.4t-a95b | Texto → texto | $1.60 entrada / $4.80 salida por 1M tokens | POST /v1/chat/completions |
| Grok Imagine Video 1.5 grok-imagine-video-1.5 | Texto, imagen → video | Entrada de imagen $0.008; salida $0.064/s (480p), $0.112/s (720p), $0.20/s (1080p) | POST /grok/v1/videos/generations GET /grok/v1/videos/{request_id} |
| Wan3.0 wan3.0 | Texto, imagen → video | Desde $0.04/s; tarifas listadas: $0.05/s (480p), $0.10/s (720p), $0.20/s (1080p) | POST /v1/videos |
| Qwen3.8 Flash qwen3.8-flash | Multimodal → texto | $0.12 entrada / $0.376001 salida por 1M tokens | POST /v1/chat/completions |
Esta tabla destaca los modelos prioritarios entre las 15 incorporaciones registradas en el Changelog de agosto de CometAPI, incluidos los precios con descuento por tiempo limitado cuando CometAPI lo indica. Dado que las afirmaciones de benchmarks provienen de distintos proveedores y fechas de lanzamiento, use el catálogo para descubrimiento y planificación de integración en lugar de un marcador universal de comparativas directas.
Actualizaciones solo de precios para gpt-5.6-sol y minimax-m3, además de ajustes de servicio para modelos DeepSeek existentes, no se cuentan como lanzamientos nuevos.
4 modelos de agosto que recomiendo
El catálogo de agosto es amplio, pero cuatro modelos destacan para diferentes cargas de trabajo. Las recomendaciones a continuación se centran en el ajuste práctico en lugar de repetir la tabla de precios; confirme la tarifa en vivo y el formato de solicitud en la página de cada modelo antes del uso en producción.
Seedance 2.5: Video multimodal más largo
Dado que la tarificación de video se factura por segundo y varía según la resolución, conserve la fecha de referencia y enlace a la página del modelo en vivo. Para Seedance 2.5, un clip 480p cuesta $0.103 por segundo mientras que un clip 720p cuesta $0.231 por segundo—más del doble—de modo que presupueste según la resolución que su carga de trabajo realmente use.
Wan3.0: Video de producción con menor costo de entrada
Wan3.0 ya está disponible para flujos de trabajo de texto a video e imagen a video. Es una opción práctica cuando los equipos necesitan un endpoint asíncrono de producción, facturación predecible por segundo y margen para comparar velocidad, calidad de movimiento y resolución frente a otros modelos de video.
GLM 5.3 Flash: Razonamiento multimodal de bajo costo
GLM 5.3 Flash es la elección enfocada en costos para alto volumen de comprensión de texto e imágenes. Pruébelo para extracción, preguntas y respuestas visuales, asistencia de codificación y pasos de agentes donde la latencia y el costo importan más que el rendimiento máximo en benchmarks.
Kimi K3: Codificación de contexto largo y trabajo de conocimiento
Kimi K3 se lanzó en julio pero siguió siendo uno de los modelos más relevantes para adoptar durante agosto. Su ventana de contexto de un millón de tokens y la ruta de chat compatible con OpenAI lo hacen útil para repositorios grandes, síntesis de investigación y flujos de trabajo de codificación de larga duración.
¿Qué nuevo modelo de IA debería usar según el caso de uso?
Gemini 3.7 Flash: Trabajo de codificación y contexto largo
Las señales publicadas enfatizan la ingeniería de software y el trabajo de conocimiento, pero la prueba útil de producción es su propio repositorio o conjunto de documentos. Ejecute un conjunto fijo de prompts, registre la tasa de tareas aceptadas, la latencia y los tokens facturados, luego compare el resultado con el modelo que ya utiliza.
Modelos de video: Movimiento, fidelidad a la referencia y costo por clip aceptado
Para Seedance 2.5, Wan3.0 y MiniMax H3, use el mismo prompt, duración, relación de aspecto e imagen de referencia. Puntúe consistencia del movimiento, adhesión al prompt, artefactos visuales, tiempo de generación y costo por clip que pase la revisión.
Modelos multimodales: Precisión antes que el máximo contexto
Para GLM 5.3 Flash, DeepSeek V4 Flash Vision y Gemini 3.7 Flash, pruebe capturas de pantalla, gráficos, PDF e insumos mixtos de texto e imagen. Una ventana de contexto grande importa solo cuando el modelo recupera la evidencia correcta y produce una respuesta estable.
DeepSeek V4 Flash Vision: Úselo para agentes de codificación visual, análisis de gráficos, capturas de pantalla y entradas de automatización de navegador. Evalúelo en sus propias tareas mixtas de texto e imagen y compare precisión, latencia y tokens facturados antes de adoptarlo en producción.
Grok Imagine Image 2.0: Úselo para canalizaciones de generación más edición, múltiples relaciones de aspecto, creatividades de producto e iteración basada en referencias. Presupueste desde la calidad y resolución que su carga de trabajo requiera, no solo el precio inicial más bajo.
Próximamente en CometAPI: Lista de seguimiento
A fecha del 3 de septiembre de 2026, esta lista de seguimiento incluye solo modelos cuyas páginas de CometAPI están marcadas como Coming Soon. Trate sus ID de modelo, rutas y precios como provisionales hasta que el catálogo confirme acceso a producción en vivo.
| Model | Model ID | Status | Decision |
|---|---|---|---|
| Qwen-Image-3.0 | qwen-image-3.0 | Coming Soon | En observación; no planificar tráfico de producción todavía. |
| Veo 4 | veo4 | Coming Soon | Espere a una ruta en vivo confirmada y facturación antes de usar en producción. |
¿Cómo llamar APIs nativas y compatibles con OpenAI en CometAPI?
CometAPI usa una sola clave de API y un flujo de facturación, pero no obliga a todos los proveedores a un mismo formato de solicitud. Use la página del modelo para elegir la ruta más adecuada: generación de contenido nativa de Gemini para Gemini, chat compatible con OpenAI para muchos LLM, endpoints de imagen para modelos de imagen y la API asíncrona de video para modelos de video. Los breves ejemplos POST a continuación muestran solo la ruta y el campo model; consulte la documentación del API para ver los parámetros completos.
- Ejemplo de LLMs de texto y multimodales: POST https://api.cometapi.com/v1beta/models/gemini-3.7-flash:generateContent
- Generación de imágenes: POST
https://api.cometapi.com/v1/images/generations - Generación de video: POST
https://api.cometapi.com/v1/videos
La ruta POST cambia con la modalidad. Gemini admite la ruta nativa /v1beta/models/{model}:generateContent así como patrones compatibles; Grok Imagine Image 2.0 usa /v1/images/generations; y Seedance 2.5 usa /v1/videos, seguido de sondeo del estado de la tarea. Utilice la API de Texto, la API de Imagen y la API de Video como fuente de la verdad.
Preguntas frecuentes
¿Cuáles son los mejores agregadores de API de IA para desarrolladores?
La mejor elección depende de si necesita solo LLM de texto o un stack más amplio de texto, imagen, audio y video. Evalúe cada agregador por ID de modelo en vivo, compatibilidad de endpoints, visibilidad de uso, soporte de respaldo, transparencia de facturación y actualización del catálogo. CometAPI merece estar en la lista corta cuando una sola clave y un flujo de facturación único a través de múltiples modalidades son prioridades.
¿Qué modelos de agosto de 2026 están realmente en vivo en CometAPI?
A fecha del 1 de septiembre, el Changelog de agosto registra 15 nuevos ID de modelo. La lista completa, formatos compatibles y notas de precios se resumen en la tabla anterior. Vuelva a comprobar el Catálogo de modelos antes del despliegue porque la disponibilidad, alias y precios pueden cambiar.
¿Puedo cambiar de proveedor sin cambiar todo mi SDK?
A menudo, pero no siempre. Muchos modelos de texto admiten /v1/chat/completions, mientras que Gemini también puede usar su ruta nativa de generación de contenido y los modelos de medios usan endpoints de imagen, tiempo real o video. CometAPI mantiene una sola clave y flujo de facturación en estos formatos, por lo que cambiar de proveedor es más sencillo incluso cuando el cuerpo de la solicitud no es idéntico.
¿Cómo funciona la generación de video?
La generación de video es asíncrona. Cree la tarea, conserve el ID de tarea devuelto y luego sondee o reciba un webhook hasta que la tarea tenga éxito o falle. Solo tras completarse la tarea la aplicación debe recuperar y almacenar el resultado.
¿Con qué frecuencia debo volver a comprobar los ID de modelo y los precios?
Verifique antes de la integración, antes de un lanzamiento a producción y antes de cualquier lote grande. Los sistemas automatizados también deberían registrar el ID de modelo exacto y la instantánea de precio utilizada para cada estimación de costos, de modo que los cambios posteriores del catálogo no reescriban el historial de una decisión de despliegue.
Conclusión
Las 15 incorporaciones de agosto en CometAPI amplían opciones prácticas en codificación, visión, imagen y video manteniendo una sola clave y un único flujo de facturación. Empiece con Seedance 2.5, Wan3.0, GLM 5.3 Flash o Gemini 3.7 Flash según la carga de trabajo, luego promocione un modelo solo después de que pruebas con prompts fijos midan calidad, latencia, confiabilidad y costo facturado.
