TL; DR xAI lanzó oficialmente Grok 4.6 el 12 de agosto de 2026 y lo puso a disposición a través de la API de xAI, Cursor y Grok Build. Tiene una ventana de contexto de 500,000 tokens, acepta texto e imágenes, ofrece cuatro niveles de esfuerzo de razonamiento, y tiene un corte de conocimiento del 1 de febrero de 2026. Según el anuncio oficial de Grok 4.6 de xAI, iguala a GPT-5.6 Sol en el Índice de Inteligencia de Artificial Analysis, un compuesto de nueve evaluaciones.
La tarificación de la API comienza en $2 por millón de tokens de entrada, $0.50 por millón de tokens de entrada en caché y $6 por millón de tokens de salida para prompts por debajo de 200,000 tokens. Cuando un prompt alcanza 200,000 tokens, toda la solicitud se factura a las tarifas de contexto largo de $4 de entrada, $1 de entrada en caché y $12 de salida por millón de tokens. Para los desarrolladores que buscan acceso flexible a múltiples modelos, plataformas como CometAPI facilitan integrar Grok 4.6 junto con otros modelos de frontera,El precio de la API es el 80% del precio de xAI.
Puntos clave
- xAI lanzó oficialmente Grok 4.6 el 12 de agosto de 2026; los informes previos de ventana de lanzamiento ahora están obsoletos.
- El ID del modelo de la API es , y el modelo también está disponible en Cursor y Grok Build.
grok-4.6 - Su ventana de contexto es 500K tokens, con entrada de texto e imagen y salida solo de texto.
- La tarifa estándar por debajo de 200K tokens de prompt es $2/M de entrada, $0.50/M de entrada en caché y $6/M de salida.
- Un prompt de 200K tokens o más activa tarifas más altas para todos los tokens de esa solicitud, no solo para los que superan el umbral.
- El esfuerzo de razonamiento puede establecerse en
low,medium,highoxhigh; es el valor predeterminado documentado. - Grok 4.6 iguala a GPT-5.6 Sol en el Índice de Inteligencia de Artificial Analysis (puntuación de 61) y muestra grandes mejoras frente a Grok 4.5 en codificación agéntica, trabajo de conocimiento y tareas de largo horizonte.
- Grok Imagine Image 2.0 es una API de generación de imágenes independiente. Grok 4.6 puede entender imágenes pero no devuelve imágenes generadas por sí mismo.
Especificaciones y precio de Grok 4.6 de un vistazo
Las siguientes especificaciones están confirmadas en la documentación del modelo de xAI y en las notas de lanzamiento del 12 de agosto.
| Especificación | Grok 4.6 |
|---|---|
| Fecha oficial de lanzamiento | August 12, 2026 |
| ID del modelo de la API | grok-4.6 |
| Posicionamiento | Modelo insignia para programación, agentes y cargas de trabajo generales |
| Ventana de contexto | 500,000 tokens |
| Entradas | Texto e imágenes |
| Salida | Texto |
| Límite documentado de salida de texto | xAI no indica un límite de salida de texto |
| Controles de razonamiento | low, medium, high y xhigh |
| Esfuerzo de razonamiento predeterminado | High |
| Corte de conocimiento | February 1, 2026 |
| Acceso nativo a la API | Disponible |
| Acceso a herramientas de programación | Cursor y Grok Build |
| Acceso a eventos actuales | Requiere herramientas de Web Search o X Search |
Precios oficiales de la API de xAI
La tabla de precios actual de la API de xAI separa solicitudes de contexto corto y de contexto largo.
| Tamaño del prompt | Entrada por 1M de tokens | Entrada en caché por 1M de tokens | Salida por 1M de tokens |
|---|---|---|---|
| Por debajo de 200,000 tokens | $2.00 | $0.50 | $6.00 |
| 200,000 tokens o más | $4.00 | $1.00 | $12.00 |
El umbral es especialmente importante para agentes sobre bases de código. Cuando el prompt de la solicitud alcanza 200,000 tokens, xAI cobra la tarifa de contexto largo para todos los tokens de esa solicitud, no solo para la parte que supera el umbral. Una solicitud con 199,000 tokens de prompt puede, por tanto, costar sustancialmente menos que otra con 200,000, incluso si sus tamaños son casi idénticos.
No se indica descuento por lotes para Grok 4.6 en la documentación de precios actual de xAI. Los equipos no deben suponer que los trabajos offline reciben los descuentos disponibles para ciertos otros modelos de xAI.
¿Qué es Grok 4.6?
Grok 4.6 es el último modelo insignia de lenguaje de SpaceXAI, lanzado el 12 de agosto de 2026. Se basa directamente en Grok 4.5 aplicando una ejecución de entrenamiento suplementario más larga centrada en datos curados generados por el modelo para razonamiento avanzado y conceptos técnicos, conjuntos de datos de ingeniería de alta calidad, un optimizador mejorado y aprendizaje por refuerzo ampliado para escenarios de programación y trabajo del conocimiento.
El modelo mantiene la misma base subyacente de 1.5 billones de parámetros que su predecesor; las ganancias provienen principalmente del post-entrenamiento y no de un aumento en la escala de parámetros. Está diseñado específicamente para mantenerse efectivo a lo largo de muchos pasos: ya sea investigando un tema, analizando grandes cantidades de información, navegando y editando una base de código desconocida, o convirtiendo una idea de alto nivel en una aplicación o artefacto de trabajo pulido. SpaceXAI enfatiza un comportamiento de autocontrol mejorado en proyectos de largo horizonte y un rendimiento más sólido en trabajos interactivos y visuales.
La diferencia con un chatbot tradicional es importante.
Un flujo de trabajo LLM convencional se ve así:
Prompt → Generar respuesta
Grok 4.6 está diseñado para flujos de trabajo más cercanos a:
Objetivo → Plan → Investigar → Usar herramientas → Modificar código → Probar → Evaluar → Continuar
El posicionamiento actual de xAI enfatiza la capacidad del modelo para mantenerse más tiempo en proyectos complejos, trabajar en bases de código, investigar temas desconocidos, construir aplicaciones y verificar su propio trabajo.
Esto hace que Grok 4.6 sea particularmente relevante para el mercado de agentes de programación y agentes autónomos de IA en rápida expansión.
¿Cuáles son las principales características de Grok 4.6?
Capacidad para agentes de ejecución prolongada
La mejora más importante de Grok 4.6 es su enfoque en tareas de larga ejecución.
En lugar de optimizar solo para respuestas de una sola vez, el modelo está diseñado para mantener el progreso a través de múltiples etapas de un proyecto.
Ejemplos típicos incluyen:
- Construir una aplicación
- Depurar un repositorio grande
- Investigar un tema desconocido
- Modificar varios componentes
- Ejecutar pruebas
- Investigar fallos
- Revisar la implementación
- Comprobar el resultado final
Este es un objetivo fundamentalmente diferente al de los benchmarks tradicionales de seguimiento de instrucciones.
Rendimiento avanzado en programación
La programación es una de las áreas de mejora más claras de Grok 4.6.
Los informes de benchmarks actuales indican:
- 65.9% en DeepSWE 1.1
- 69.9% en CursorBench 3.2
- 61.3% en FrontierCode 1.1 Extended
Estas evaluaciones son especialmente relevantes porque apuntan al comportamiento de agentes de programación y no a un simple autocompletado de código.
La mejora de Grok 4.5 a Grok 4.6 en DeepSWE 1.1 es especialmente notable, subiendo de aproximadamente 54% a 65.9% en la comparación reportada.
Entrada multimodal
Grok 4.6 admite entradas de texto e imagen, lo que permite a los desarrolladores combinar información visual con razonamiento.
Aplicaciones potenciales incluyen:
- Depuración con capturas de pantalla
- Análisis de UI
- Interpretación de gráficos
- Comprensión de documentos
- Investigación visual
- Tareas de programación basadas en imágenes
Esto hace a Grok 4.6 más flexible que un modelo de programación puramente basado en texto.
Búsqueda web y en X
El acceso a la búsqueda es una parte significativa del ecosistema de Grok.
La API admite:
- Búsqueda web
- Búsqueda en X
- Llamadas a funciones
- Ejecución de código
La documentación actual de la API de Grok 4.5 de xAI confirma estas capacidades de herramientas en el entorno de la API de Grok.
Para agentes de investigación, esto significa que el modelo puede potencialmente pasar de conocimiento preentrenado estático a recuperación de información actual más razonamiento.
Razonamiento configurable
La API de Grok expone un esfuerzo de razonamiento configurable.
Esto permite a los desarrolladores equilibrar:
velocidad / coste ↔ profundidad de razonamiento
Para tareas simples, un razonamiento inferior puede reducir cómputo innecesario.
Para tareas complejas de programación o investigación, un razonamiento superior puede proporcionar una resolución de problemas más deliberada.
Rendimiento de frontera con coste competitivo
El precio de Grok 4.6 es, probablemente, una de sus mayores ventajas comerciales.
El precio estándar reportado de la API es:
- $2 / 1M tokens de entrada
- $6 / 1M tokens de salida
Es el mismo precio informado para Grok 4.5, a pesar de las mejoras significativas en capacidades.
Esto crea una propuesta de coste/rendimiento inusualmente agresiva para un modelo de frontera.
¿Cómo se desempeña Grok 4.6 en benchmarks?
Los datos de benchmark más útiles se concentran en torno a inteligencia agéntica y programación.
| Benchmark | Grok 4.6 | Qué mide |
|---|---|---|
| Índice de Inteligencia de Artificial Analysis | 61 | Inteligencia amplia de modelos de frontera |
| CursorBench 3.2 | 69.9% | Desempeño de agentes de programación |
| DeepSWE 1.1 | 65.9% | Agentes de ingeniería de software |
| FrontierCode 1.1 Extended | 61.3% | Programación avanzada |
| GDPVal-AA v2 | 1,753 Elo | Desempeño en tareas de trabajo del conocimiento |
La puntuación de 61 en el Índice de Inteligencia de Artificial Analysis sitúa, según se informa, a Grok 4.6 al mismo nivel que GPT-5.6 Sol en ese índice.
La puntuación de 1,753 Elo en GDPVal-AA v2 también es significativa porque GDPVal evalúa tareas profesionales de trabajo del conocimiento y no simplemente preguntas académicas.
La conclusión importante de los benchmarks
La evidencia más sólida para Grok 4.6 no es una única puntuación estilo MMLU.
Su perfil de benchmarks apunta a:
programación + agentes + trabajo del conocimiento + ejecución de largo recorrido
Exactamente hacia donde se mueve el desarrollo moderno de IA.
Para un sitio como CometAPI, esta es una distinción importante que preservar: Grok 4.6 debería comercializarse principalmente como un modelo de frontera orientado a agentes, no como otro modelo genérico de chatbot.
¿Cómo se compara Grok 4.6 con su predecesor y competidores?
Grok 4.6 vs Grok 4.5
| Característica | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Enfoque principal | Razonamiento general + agentes | Agentes de larga ejecución + programación |
| Contexto | Despliegue clase 500K | 500K |
| Entrada | Texto + imagen | Texto + imagen |
| Búsqueda web | Sí | Sí |
| Búsqueda en X | Sí | Sí |
| Ejecución de código | Sí | Sí |
| Llamadas a funciones | Sí | Sí |
| Precio de entrada | $2/M | $2/M |
| Precio de salida | $6/M | $6/M |
| DeepSWE 1.1 | ~54% | 65.9% |
| Índice de Inteligencia | ~56 | 61 |
Lo importante es que Grok 4.6 no parece ser un simple reemplazo por nivel de precio de Grok 4.5. Es una mejora de capacidad más orientada a flujos de trabajo agénticos de largo horizonte.
La documentación actual de Grok 4.5 de xAI lista el modelo a $2/$6 por millón de tokens, con razonamiento configurable y soporte de herramientas.
Tabla comparativa: Grok 4.6 vs competidores clave
| Aspecto | Grok 4.6 | GPT-5.6 Sol | Claude Fable 5 / Opus 5 | Notas |
|---|---|---|---|---|
| Índice de Inteligencia de AA | 61 | 61 | 62 / 63 | Puntuación compuesta |
| Entrada / Salida $/1M | $2 / $6 | ~$5 / $30 | ~$5 / $25 | Grok mucho más barato en salida |
| Ventana de contexto | 500K | Hasta 1M+ | A menudo 1M | — |
| Fortalezas | Agentes, eficiencia en programación, coste | Razonamiento amplio, programación | Largo horizonte, seguridad | — |
| Integración con Cursor | Nativa, sólida | Disponible | Disponible | Grok optimizado para Cursor |
| Eficiencia por turno | Alta (menos pasos) | Competitiva | Se reportan más pasos | Importante para agentes |
| Disponibilidad | API + Cursor + socios | Oficial + socios | Oficial + socios | CometAPI unifica el acceso |
Datos extraídos del anuncio de SpaceXAI, Artificial Analysis y fichas públicas de modelos a fecha 13 de agosto de 2026.
La comparación actual de Artificial Analysis es particularmente interesante.
Se informa que Grok 4.6 obtiene 61 en el Índice de Inteligencia, igualando a GPT-5.6 Sol. Pero la economía es muy diferente.
Los precios exactos de las variantes competidoras de GPT deben comprobarse frente a los precios actuales de sus proveedores antes de publicar, pero la observación clave del mercado es clara: Grok 4.6 compite a nivel de benchmarks de frontera manteniendo un precio por token relativamente agresivo.
Eso hace que Grok 4.6 sea particularmente atractivo para aplicaciones en las que la ejecución de agentes de alto volumen haría que los modelos de frontera premium resultaran costosos.
¿Cuáles son las limitaciones de Grok 4.6?
Un contexto de 500K es menor que el de algunos competidores con 1M
El contexto de 500K de Grok 4.6 es grande, pero no es la ventana de contexto más grande disponible en el mercado de modelos de frontera.
Para repositorios muy grandes o colecciones de documentos enormes, un modelo con contexto de 1M puede tener ventaja.
Modelo propietario
A diferencia de MiMo-V2.5-Pro, Grok 4.6 no es un modelo de pesos abiertos.
Los desarrolladores no pueden descargar el modelo y desplegarlo de forma independiente.
Las comparaciones de benchmarks requieren cuidado
Diferentes benchmarks de programación usan distintos arneses, prompts, herramientas y procedimientos de evaluación.
Por ejemplo, SWE-Bench Pro está diseñado específicamente en torno a problemas realistas de ingeniería de software de largo horizonte, y los resultados del benchmark pueden variar sustancialmente según el andamiaje del agente.
Por lo tanto, 69.9% en CursorBench no debe interpretarse como "Grok 4.6 es 69.9% mejor que otro modelo."
La interpretación correcta es que logró esa puntuación bajo la configuración particular de evaluación del benchmark.
El costo de un agente puede ser mayor de lo que sugiere el precio por token
El precio de $2/$6 es atractivo, pero un agente autónomo puede consumir cantidades enormes de tokens mediante:
- Llamadas a herramientas
- Búsquedas repetidas
- Ejecución de código
- Intentos fallidos
- Contexto largo
- Autoverificación
Por lo tanto, la economía unitaria real depende del costo por tarea completada con éxito, no simplemente del costo por millón de tokens.
Precio y acceso
Precios oficiales (nivel estándar, por debajo de ~200K tokens de prompt):
- Entrada: $2.00 por 1M de tokens
- Entrada en caché: aproximadamente $0.50 por 1M de tokens
- Salida: $6.00 por 1M de tokens
Una variante más rápida tiene un precio del doble de estas tarifas. Las tarifas pueden duplicarse para contextos muy largos (≥200K). Se recomienda encarecidamente la caché de prompts para bucles de agentes a fin de mantener bajos los costos.
Disponibilidad:
- Cursor y Grok Build (uso incluido 2× durante la primera semana)
- SpaceXAI API (grok-4.6)
- Socios: OpenRouter, Vercel, Cloudflare y otros
- SuperGrok chat/apps (a través del selector de modelo)
Recomendación de CometAPI: Para desarrolladores que ya usan (o planean usar) múltiples modelos de frontera, CometAPI ofrece acceso sin fricciones a Grok 4.6 mediante un único endpoint compatible con OpenAI (https://api.cometapi.com/v1). Obtiene facturación unificada, analítica de uso, tarifas efectivas competitivas en más de 500 modelos (incluyendo GPT, Claude, Gemini, DeepSeek y variantes de Grok) y la capacidad de cambiar de modelo con una sola línea. Esto es especialmente valioso al hacer A/B testing de Grok 4.6 frente a otros modelos de programación o agentes, o al crear sistemas de producción que se benefician de enrutamiento y fallback entre modelos. Regístrese en cometapi.com para obtener una clave de API gratuita y explorar el catálogo de modelos en vivo.
¿Debería cambiarse a Grok 4.6?
Sí, si:
- Trabaja mucho en Cursor o construye agentes de programación/conocimiento de larga ejecución y quiere una fiabilidad de múltiples pasos sólida a coste competitivo.
- La economía por tokens importa—Grok 4.6 ofrece inteligencia casi a la par de GPT-5.6 Sol a aproximadamente una quinta parte del precio por token de salida de las opciones de frontera más caras.
- Valora la eficiencia por turno (menos pasos y tokens para completar tareas complejas).
- Quiere acceso inmediato a un modelo entrenado explícitamente para flujos de trabajo interactivos, visuales y agénticos comunes en el desarrollo moderno.
Considere mantenerse con o mezclar otros modelos si:
- Su carga principal es programación competitiva pura o fortalezas específicas de modelos cerrados (p. ej., ciertos escenarios de contexto largo o seguridad ajustada de Claude).
- Requiere las puntuaciones absolutamente más altas en cada benchmark individual de ingeniería de software sin importar el costo.
- Necesita ventanas de contexto mayores que 500K para cargas de una sola llamada (algunos competidores ofrecen 1M+).
La mayoría de los equipos se beneficiarán de evaluar Grok 4.6 junto a su stack actual. Dado que está disponible a través de agregadores como CometAPI, el costo de cambio es bajo—simplemente cambie el nombre del modelo y mida tasas de finalización de tareas del mundo real, latencia y costo en sus propias cargas.
Conclusión
Grok 4.6 representa un avance significativo para SpaceXAI: inteligencia a nivel de frontera en índices compuestos y benchmarks agénticos, mejoras significativas en el rendimiento de programación y trabajo del conocimiento de largo recorrido, y un precio agresivo que deja atrás a muchos competidores de código cerrado. Su disponibilidad nativa en Cursor, combinada con una sólida fiabilidad de múltiples pasos, lo hace particularmente atractivo para desarrolladores que construyen agentes de software y aplicaciones interactivas del mundo real.
Ya sea que acceda a él directamente, a través de Cursor/Grok Build, o mediante una pasarela unificada como CometAPI, Grok 4.6 está listo para evaluación en producción hoy. Visite el anuncio oficial en x.ai/news/grok-4-6 para obtener todos los detalles y la ficha del modelo, explore el catálogo en vivo en cometapi.com para compararlo junto a otros modelos líderes y comience a crear con las nuevas capacidades de inmediato.
Fuentes principales
- Anuncio oficial: https://x.ai/news/grok-4-6
- Documentación de SpaceXAI: https://docs.x.ai/developers/models/grok-4-6
- Evaluaciones y artículos de Artificial Analysis
- Blog de Cursor: https://cursor.com/blog/grok-4-6
- Cobertura independiente de SiliconANGLE, 9to5Mac, VentureBeat, The Decoder y otros (12–13 de agosto de 2026)
Verifique siempre los precios, límites de tasa y números de benchmark más recientes en las páginas oficiales, ya que el panorama de IA evoluciona rápidamente.
