Especificaciones técnicas de Grok 4.6
| Elemento | Grok 4.6 |
|---|---|
| Proveedor | xAI |
| ID del modelo | grok-4.6 |
| Tipo de modelo | Modelo de vanguardia de razonamiento multimodal y agéntico |
| Fortalezas principales | Agentes de larga ejecución, programación, trabajo de conocimiento, creación de aplicaciones interactivas/visuales |
| Modalidades de entrada | Texto e imágenes |
| Modalidad de salida | Texto |
| Ventana de contexto | 500,000 tokens |
| Fecha de corte del conocimiento | 1 de febrero de 2026 |
| Límite de salida | xAI no ha publicado un límite de salida de texto |
| Razonamiento | low, medium, high (predeterminado), xhigh |
| APIs | Responses API, Chat Completions |
| Herramientas | Llamadas a funciones, búsqueda web, búsqueda en X, ejecución de código |
| Precios de la API | $2 / 1M input tokens; $6 / 1M output tokens |
| Variante rápida | Disponible a 2× el precio estándar |
| Lanzamiento | 12 de agosto de 2026 |
¿Qué es Grok 4.6?
Grok 4.6 es el modelo de vanguardia más reciente de xAI, centrado en la inteligencia agéntica.
La diferencia con un chatbot tradicional es importante.
xAI destaca la capacidad del modelo para mantenerse durante más tiempo en proyectos complejos, trabajar a través de bases de código, investigar temas desconocidos, crear aplicaciones y verificar su propio trabajo.
Esto hace que Grok 4.6 sea especialmente relevante para el mercado, en rápida expansión, de agentes de codificación de IA y agentes autónomos.
Características principales de Grok 4.6
- Ejecución de agentes de larga duración: Grok 4.6 está entrenado para sostener trabajos complejos a lo largo de muchos pasos en lugar de optimizar solo para respuestas de un solo turno.
- Programación agéntica: Se orienta a la ingeniería de software a nivel de repositorio, generación de código, depuración, pruebas iterativas y entornos de programación específicos de dominio.
- Investigación para trabajo de conocimiento: El modelo puede investigar dominios desconocidos, organizar información, razonar sobre requisitos complejos y convertir hallazgos en un entregable concreto.
- Creación de aplicaciones visuales e interactivas: xAI reporta mejores resultados en el primer intento para proyectos visuales e interactivos, incluyendo convertir una idea de producto en una aplicación funcional y refinarla mediante bucles de retroalimentación.
- Autopruebas y verificación: En trayectorias más largas, xAI observó más comportamientos en los que el modelo comprueba su propio trabajo antes de continuar.
- Uso nativo de herramientas: Grok 4.6 admite llamadas a funciones, búsqueda web, búsqueda en X y ejecución de código a través de la API.
- Razonamiento configurable: Los desarrolladores pueden elegir
low,medium,highoxhigh, lo que hace que el modelo se adapte tanto a cargas sensibles a la latencia como a trabajos de razonamiento profundo.
Rendimiento en benchmarks de Grok 4.6
xAI informa que Grok 4.6 iguala a GPT-5.6 Sol en el Artificial Analysis Intelligence Index, un compuesto de nueve benchmarks. Sus resultados publicados más sólidos incluyen:
| Benchmark | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
Estas cifras provienen del anuncio de lanzamiento de xAI del 12 de agosto. xAI señala que las cifras de terceros se toman de fichas de sistema de desarrolladores o de tablas públicas de clasificación de benchmarks, por lo que los resultados entre modelos deben interpretarse teniendo en cuenta la metodología de evaluación y la configuración del modelo.
Grok 4.6 vs Grok 4.5 vs GPT-5.6 Sol vs Claude Fable 5
| Modelo | Posicionamiento principal | Contexto | AA Intelligence | Perfil de programación/agéntico |
|---|---|---|---|---|
| Grok 4.6 | Agentes de larga ejecución, programación, trabajo de conocimiento | 500K | 61 | Fuerte programación agéntica y flujos de trabajo de proyectos interactivos |
| Grok 4.5 | Modelo de vanguardia generalista y de programación, rápido | 500K | 56 | Sólida base para flujos de trabajo de programación y agentes |
| GPT-5.6 Sol | Razonamiento general de vanguardia y trabajo agéntico | Published competitor context varies by deployment | 61 | Resultados sólidos en DeepSWE y Terminal-Bench |
| Claude Fable 5 | Trabajo de conocimiento y programación de vanguardia | Published competitor context varies by deployment | 62 | Muy sólido en CursorBench, FrontierCode, APEX-SWE |
Grok 4.6 resulta más convincente cuando la carga de trabajo requiere ejecución sostenida en lugar de una única respuesta de alta calidad. Es especialmente atractivo para desarrolladores que construyen agentes que investigan repetidamente, llaman herramientas, editan código, prueban resultados y continúan desde el contexto acumulado. Claude Fable 5 mantiene ventaja en varios benchmarks publicados de programación y agentes, mientras que GPT-5.6 Sol supera a Grok 4.6 en DeepSWE y Terminal-Bench en la comparación de xAI.
Limitaciones y consideraciones
- Los resultados en benchmarks dependen de la tarea: Grok 4.6 no es uniformemente el modelo con la puntuación más alta. Sus resultados publicados muestran fortalezas y debilidades claras en diferentes evaluaciones agénticas.
- Las cargas de trabajo de larga duración pueden consumir muchos tokens: Una ventana de contexto grande y el uso iterativo de herramientas pueden aumentar el consumo total de inferencia incluso cuando el precio por token es competitivo.
- La configuración de herramientas importa: La búsqueda web, la búsqueda en X, la ejecución de código y las llamadas a funciones requieren una arquitectura de aplicación que pueda gestionar de forma segura los permisos de las herramientas y los datos devueltos.
- Fecha de corte del conocimiento: La fecha documentada es el 1 de febrero de 2026. Para información más reciente, los desarrolladores deben usar herramientas de recuperación o de búsqueda web apropiadas en lugar de confiar en el conocimiento estático del modelo.
- La caché requiere configuración deliberada: xAI recomienda
prompt_cache_keypara la Responses API yx-grok-conv-idpara Chat Completions a fin de mejorar la fiabilidad de aciertos de caché.
Casos de uso de Grok 4.6
- Agentes de programación autónomos — análisis de repositorios, implementación, depuración, pruebas y correcciones iterativas.
- Prototipado de productos — convertir requisitos amplios de producto en aplicaciones interactivas funcionales.
- Agentes de investigación técnica — investigar dominios técnicos desconocidos y producir entregables estructurados.
- Copilotos de desarrollador — generación de código, revisión, depuración y flujos de desarrollo de varios pasos.
- Automatización del trabajo de conocimiento — análisis de documentos, síntesis de información, planificación y generación de salidas estructuradas.
- Asistentes con uso de herramientas — aplicaciones que combinan el razonamiento del modelo con búsqueda web, búsqueda en X, ejecución de código y llamadas a funciones personalizadas.
Cómo acceder a la API de Grok 4.6
Para las aplicaciones que ya usan la capa de API unificada de CometAPI, utilice el ID de modelo de Grok 4.6 expuesto por CometAPI y siga el endpoint/esquema actual en la documentación de la API de CometAPI. Esto puede reducir el trabajo de integración específico del proveedor cuando una aplicación necesita cambiar entre LLMs de vanguardia.
Un flujo de trabajo típico es:
- Cree o inicie sesión en una cuenta de CometAPI.
- Cree un token de API en la consola de CometAPI.
- Seleccione el endpoint del modelo
grok-4.6. - Envíe solicitudes a través del endpoint de CometAPI usando el esquema de solicitud documentado para el modelo.
- Procese en su aplicación el texto devuelto, las llamadas a herramientas o la salida estructurada.