
AUTO
CometAPI Auto API is an intelligent model routing feature that allows developers to access the appropriate AI model without specifying a specific model ID for each request.
Elige tu plan
Elige tu plan
Busca y compara modelos de texto, imagen, video y audio de los principales proveedores. Revisa funciones y precios, e intégralos con una sola clave de API.

CometAPI Auto API is an intelligent model routing feature that allows developers to access the appropriate AI model without specifying a specific model ID for each request.

Explora la API de MiniMax-M3.1-Flash-Preview.

MiMo-V2.6-Pro-UltraSpeed es la versión de inferencia de baja latencia de MiMo-V2.6-Pro de Xiaomi, diseñada para aplicaciones en las que la capacidad de razonamiento del modelo Pro debe combinarse con una generación de salida sustancialmente más rápida.

GPT-6 Sol (gpt-6-sol) es un modelo de razonamiento GPT-6 de OpenAI diseñado para programación compleja, flujos de trabajo con agentes y trabajo de conocimiento exigente. OpenAI lo describe como un modelo para programación compleja y flujos de trabajo con agentes, con razonamiento adaptativo, procesamiento de contextos extensos, entrada de imágenes y acceso a un amplio conjunto de herramientas a través de la Responses API.

GPT-6 Luna (gpt-6-luna) es el modelo GPT-6 eficiente de OpenAI para cargas de trabajo enfocadas y de gran volumen. OpenAI sitúa a Luna por debajo de GPT-6 Sol dentro de la familia GPT-6, haciendo hincapié en la eficiencia, la repetibilidad y el uso en producción sensible a los costos.

MiMo-V2.6-Flash es el modelo de Xiaomi centrado en la eficiencia dentro de la familia MiMo-V2.6. Es un modelo nativo de razonamiento multimodal diseñado para llamadas de alta frecuencia, cargas de trabajo a gran escala, programación, automatización y tareas de agentes de horizonte largo.

MiMo-V2.6-Pro es el modelo de razonamiento insignia de Xiaomi MiMo dentro de la familia MiMo-V2.6. Es un modelo multimodal nativo diseñado para trabajos complejos y de largo horizonte en ingeniería de software, investigación, ciberseguridad, flujos de trabajo con agentes, análisis multimodal y creación de contenidos.

Hy-Image 3.5 Preview (hy-image-v3.5-preview) es el modelo profesional de generación de imágenes de Tencent Hunyuan, centrado en la generación de texto a imagen, la generación guiada por referencias y la edición de imágenes en múltiples turnos.

Grok Build 0.1 es el modelo especializado de xAI para la programación con agentes y la ingeniería de software.

Claude Opus 5.5, lanzado el 22 de septiembre de 2026 y diseñado para programación basada en agentes de ejecución prolongada y trabajo del conocimiento.

Inteligencia de próxima generación para agentes de larga duración

MiniMax H3 Max es una variante de gama alta de la familia H3 de generación de video de MiniMax. Las integraciones documentadas de H3 Max admiten la generación de texto a video e imagen a video. Los materiales oficiales de H3 de MiniMax describen el sistema H3 más amplio como un modelo de video omnimodal con audio estéreo nativo.

Próximamente

Grok 4.7 es el modelo de frontera de SpaceXAI para programación, tareas agénticas y trabajo del conocimiento. Sucede a Grok 4.6 y utiliza un modelo base más grande, además de un entrenamiento de aprendizaje por refuerzo más prolongado centrado en tareas difíciles y de varias horas.

Claude Opus 5.2 podría estar en pruebas limitadas en Claude Code. Esto es lo que afirman las filtraciones, lo que sigue sin verificarse y cómo funcionaría el acceso a CometAPI tras el lanzamiento.

Explora la API de Gemini 4 Pro.

El lanzamiento de Grok 4.20 introduce una arquitectura multiagente (varios agentes especializados coordinados en tiempo real), modos de contexto ampliados y mejoras centradas en el seguimiento de instrucciones, la reducción de alucinaciones y las salidas estructuradas y compatibles con herramientas.

GPT-6 Astra, el modelo insignia para razonamiento complejo y programación. Elija GPT-5.6 Terra para equilibrar inteligencia y costo,

Genera videos a partir de prompts de texto, anima imágenes fijas o edita videos existentes con lenguaje natural. La API admite duración, relación de aspecto y resolución configurables para los videos generados — y el SDK se encarga automáticamente del sondeo asíncrono.

Explora la API de Jev.

Desde la verificación rápida hasta la salida cinematográfica, la facturación se basa en la duración del video generado, en la selección de la resolución adecuada y en la conversión de cada generación en una regla de actividad de inversión creativa planificada.

Grok Imagine Image 2.0, su modelo mejorado de generación y edición de imágenes con IA

GLM-5.3-FlashX is Z.ai's high-speed API serving variant of GLM-5.3-Flash, designed for applications where model capability needs to be paired with lower response latency and high generation throughput.

GPT Image 2 es el modelo de generación de imágenes de última generación de OpenAI para generar y editar imágenes de forma rápida y de alta calidad. Admite tamaños de imagen flexibles y entradas de imagen de alta fidelidad.

Qwen3.8-Omni-Flash (qwen3.8-omni-flash) es el modelo nativo omnimodal de Alibaba Cloud para la comprensión de audio/video y el análisis de contenido multimodal.

GLM-5.3-Flash es el primer modelo multimodal nativo de la serie GLM-5, que ofrece una inteligencia más sólida que GLM-5.2 mientras mantiene una arquitectura excepcionalmente eficiente en costos.

minimax-h3 es un nuevo modelo de generación de video diseñado para la producción creativa de alta calidad. Ofrece una mejor comprensión de los prompts, mayor consistencia visual, movimiento más fluido y un control más flexible de las imágenes de referencia para flujos de trabajo de generación de video de calidad cinematográfica.

Genera imágenes a partir de prompts de texto con los modelos Grok Imagine. La API admite la generación por lotes de múltiples imágenes y el control sobre la relación de aspecto y la resolución.

Gemini 3.8 Flash es un modelo Gemini ligero de nueva generación, con el objetivo de lograr un mejor equilibrio entre velocidad, costo y capacidad de programación.

FLUX 3 - Modelos del mundo real: hacia modelos de flujo multimodales como la espina dorsal de la inteligencia visual.

Minimax-m3 es un modelo de IA multimodal diseñado para un razonamiento sólido, conversación natural y generación creativa de contenido. Ofrece un rendimiento equilibrado en tareas de comprensión textual y visual, lo que lo hace adecuado para aplicaciones de IA de propósito general.

MiniMax-M2.7 ofrece la misma inteligencia de primer nivel que la versión estándar, incluida la autoevolución recursiva y la productividad de oficina de nivel experto, pero está diseñado para aplicaciones que requieren latencia inferior a un segundo y generación de tokens de alta velocidad. Gracias a una arquitectura de backbone de inferencia mejorada, su velocidad de salida es un 66 % más rápida que la del modelo estándar (alcanzando 100 tps). Es la opción preferida para asistentes interactivos de programación, ejecución de bucles de agentes en tiempo real y pipelines empresariales de alto rendimiento con requisitos estrictos de tiempo de finalización.