Resumen
Grok 4.7 ahora tiene su señal de pre-lanzamiento más clara: una cuenta regresiva de diez días del 2 de septiembre apunta a un lanzamiento esperado alrededor del 12 de septiembre de 2026. Declaraciones anteriores describieron un modelo con aproximadamente 2.1 billones de parámetros y entrenamiento suplementario utilizando datos sustanciales de la empresa SpaceX. Sin embargo, xAI aún no ha publicado una model card de Grok 4.7, un conjunto de benchmarks, el identificador final del API, la ventana de contexto ni los precios oficiales. Hasta que aparezcan esos detalles, el Grok 4.6 lanzado sigue siendo la línea base de producción medible.
Puntos clave
- La fecha esperada del 12 de septiembre se infiere de la cuenta regresiva de diez días de Musk, no de un anuncio de calendario publicado por separado por xAI.
- La escala de 2.1T y las declaraciones sobre datos de SpaceX son afirmaciones previas al lanzamiento; los parámetros activos, el enrutamiento, la arquitectura y la metodología de entrenamiento siguen sin publicarse.
- Grok 4.6 ya muestra sólidos resultados en trabajo de conocimiento y agentes, incluido 61.3% en FrontierCode v1.1 (Extended), pero queda detrás del modelo de comparación más fuerte en varias evaluaciones de programación difíciles.
- Grok 4.7 debe juzgarse por la tasa de aceptación de tareas, la fiabilidad en horizontes largos, la eficiencia de tokens, la latencia y el costo por resultado exitoso, no solo por el recuento de parámetros.
- CometAPI integrará Grok 4.7 tan pronto como xAI lance oficialmente el modelo y esté disponible el acceso al endpoint de producción; los desarrolladores aún deben validar el ID del modelo en vivo, el precio y el comportamiento de respuesta antes de migrar.
¿Qué es Grok 4.7?
Grok 4.7 es el sucesor anunciado de Grok 4.6 y se espera que continúe el enfoque de xAI en programación, ingeniería, agentes de larga duración y trabajo profesional de conocimiento. La evidencia pública actualmente consiste en declaraciones del fundador y una cuenta regresiva de lanzamiento más que en un paquete técnico completo de lanzamiento.
La distinción más importante es entre tres objetos: el modelo Grok 4.7 anunciado, las señales previas al lanzamiento que describen su posible escala y entrenamiento, y el Grok 4.6 de producción en vivo. Los desarrolladores deben tratar Grok 4.7 como un candidato próximo a evaluación hasta que xAI publique la documentación final y una solicitud de producción tenga éxito contra el endpoint lanzado.
Fecha de lanzamiento y cronograma de Grok 4.7
¿Cuándo se espera que se lance Grok 4.7?
La declaración de Musk del 2 de septiembre de que el modelo llegaría en diez días apunta aproximadamente al 12 de septiembre de 2026
Fuente: Elon Musk en X, 2 de septiembre de 2026
Cronograma de lanzamiento de Grok 4.7
| Fecha | Señal pública | Interpretación |
|---|---|---|
| Finales de julio de 2026 | Musk describió un modelo de aproximadamente 2.1T, eficiencia de tokens mejorada y un servicio algo más lento. | Expectativas de escala del modelo y eficiencia declaradas por el fundador. |
| 12 de agosto de 2026 | Se describió que el entrenamiento inicial estaba completo; el entrenamiento suplementario incluyó supuestamente datos sustanciales de la empresa SpaceX. | Una actualización del progreso de entrenamiento, no una confirmación de lanzamiento. |
| 2 de septiembre de 2026 | “Grok 4.7 sale en 10 días.” | La cuenta regresiva de lanzamiento público más clara hasta ahora. |
| 12 de septiembre de 2026 | Fecha de calendario derivada de la cuenta regresiva. | Objetivo esperado; la disponibilidad final aún requiere un aviso de lanzamiento de xAI y un endpoint operativo. |
Especificaciones de Grok 4.7: Información confirmada vs no confirmada
La forma más útil de leer la información actual de Grok 4.7 es separar las declaraciones directas del fundador de las especificaciones que xAI no ha publicado. La nueva publicación confirma solo el nombre del modelo y una cuenta regresiva de lanzamiento; no añade parámetros técnicos ni resultados de benchmarks.
| Especificación | Estado actual de Grok 4.7 | Nivel de evidencia |
|---|---|---|
| Tiempo de lanzamiento | Alrededor del 12 de septiembre, inferido de la cuenta regresiva de diez días del 2 de septiembre | Objetivo anunciado por el fundador |
| Escala del modelo | Aproximadamente 2.1T parámetros | Declarado por el fundador |
| Entrenamiento inicial | Descrito como completo para el 12 de agosto | Declarado por el fundador |
| Entrenamiento suplementario | Incluye datos sustanciales de la empresa SpaceX | Declarado por el fundador |
| Calidad relativa | Se afirma que es significativamente mejor que Grok 4.6 | Afirmación no verificada |
| Eficiencia de tokens | Mejora afirmada sobre Grok 4.6 | Afirmación no verificada |
| Velocidad de servicio | Se espera que sea algo más lenta | Declarado por el fundador |
| Ventana de contexto | No publicada por xAI | Desconocido |
| Modalidades de entrada/salida | No publicadas por xAI | Desconocido |
| ID final del modelo en el API | No confirmado en la documentación de xAI | Desconocido |
| Precios oficiales | No publicados por xAI | Desconocido |
| Benchmarks oficiales | Ninguno publicado para Grok 4.7 | Desconocido |
La afirmación de aproximadamente 2.1T parámetros no revela parámetros activos, esparsidad, enrutamiento por expertos, costo de inferencia ni cómputo efectivo de entrenamiento. El recuento de parámetros por sí solo no puede establecer la calidad en producción.
Por qué la señal de entrenamiento de SpaceX puede importar más que 2.1T
La divulgación más trascendente puede ser el suplemento de datos de la empresa SpaceX. Un corpus de ingeniería de alta calidad podría mejorar el razonamiento técnico, el diseño, la depuración, la optimización y el trabajo de agentes de largo horizonte, donde la distribución de tareas y la calidad posterior al entrenamiento a menudo importan más que la escala bruta.
Esta dirección es consistente con la estrategia de modelos lanzados por xAI. El informe de entrenamiento de Grok 4.6 describe una carrera de entrenamiento suplementaria más larga con datos de ingeniería de alta calidad, seguida de ajuste fino supervisado y aprendizaje por refuerzo en programación, STEM, desarrollo web, optimización de kernel y diseño asistido por computadora.
Eso hace que la afirmación sobre Grok 4.7 sea técnicamente plausible, no probada. Una ventaja real debería hacerse visible después del lanzamiento en pruebas de ingeniería reproducibles, tasas de finalización de tareas, latencia y costo por resultado exitoso.
Grok 4.7 vs Grok 4.6: lo que muestra la línea base
Aún no existen puntuaciones oficiales de Grok 4.7. El punto de comparación responsable es la evaluación del Grok 4.6 lanzado por xAI. La visión completa del modelo aparece en el análisis detallado de Grok 4.6 de CometAPI; la siguiente tabla mantiene solo las filas de benchmark más relevantes para la toma de decisiones.
| Evaluación oficial | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
Resultado de referencia: Grok 4.6 demuestra una ventaja real sobre Grok 4.5 en cada fila mostrada. Igual a GPT-5.6 Sol en el índice general de inteligencia, lidera este grupo en GDPVal-AA v2 y supera ligeramente a GPT-5.6 Sol en FrontierCode. Sus principales brechas publicadas siguen siendo DeepSWE y Terminal-Bench.
Estos resultados establecen un estándar concreto para Grok 4.7. Si el modelo más grande y el entrenamiento suplementario orientado a ingeniería se trasladan a producción, el avance esperado sería un código a nivel de repositorio y una finalización de tareas en terminal más sólidos sin perder la fortaleza de Grok 4.6 en trabajo de conocimiento. Un objetivo ambicioso creíble es competir con el Claude Fable 5.1 lanzado en programación y flujos de trabajo de agentes de larga duración. Eso es una previsión a probar, no una afirmación de benchmark actual.
Grok 4.7 vs Grok 4.6: avances esperados y guía de actualización
Las señales filtradas y declaradas por el fundador sugieren cinco áreas donde Grok 4.7 puede mejorar. Dado que xAI no ha publicado datos de evaluación finales, cada expectativa debe convertirse en una prueba de aceptación medible.
Programación a nivel de repositorio
Grok 4.6 ya es fuerte en CursorBench y FrontierCode, pero sus resultados en DeepSWE y Terminal-Bench dejan un margen visible de mejora. Grok 4.7 debe demostrar mayor aceptación de parches, menos regresiones y mejor recuperación en la línea de comandos en los mismos repositorios antes de reemplazar a 4.6.
Fiabilidad de agentes de largo horizonte
La señal de datos de SpaceX y la dirección de entrenamiento de agentes existente de xAI sugieren un enfoque en trabajo de ingeniería multietapa. Mida flujos de trabajo completados, llamadas a herramientas fallidas, reintentos, intervenciones humanas y recuperación tras errores, no solo la calidad de la prosa final.
Trabajo de conocimiento y razonamiento técnico
Grok 4.6 ya lidera el conjunto de comparación en GDPVal-AA v2. Grok 4.7 debe preservar esa ventaja mientras mejora la transferencia a revisiones de diseño, síntesis de investigación, depuración, optimización y otras tareas técnicas complejas.
Eficiencia de tokens
Un modelo más grande aún puede ser más barato por tarea exitosa si llega a resultados correctos en menos pasos. Compare tokens de entrada totales, entrada en caché, tokens de salida, reintentos y costo para el mismo resultado aceptado.
Compensaciones en el servicio
Si Grok 4.7 es más lento, las ganancias de calidad deben superar la latencia. Registre el tiempo hasta el primer token, el rendimiento sostenido, el tiempo de pared para completar tareas, la tasa de errores y el costo bajo concurrencia realista.
Benchmarks de Grok 4.7: 5 pruebas para verificar una mejora real sobre Grok 4.6
- Éxito en ingeniería de software: mida issues resueltos, tests que pasan, tasa de regresiones y aceptación de parches en repositorios representativos.
- Fiabilidad de agentes de largo horizonte: rastree flujos de trabajo completados, fallas en llamadas a herramientas, reintentos, recuperación e intervenciones humanas en ejecuciones multietapa.
- Transferencia de ingeniería al mundo real: pruebe diseño, depuración, optimización, razonamiento científico y tareas relacionadas con CAD con criterios de evaluación divulgados.
- Eficiencia de tokens por tarea exitosa: compare tokens totales y gasto requerido para alcanzar el mismo resultado aceptado.
- Latencia y costo bajo carga de producción: evalúe tiempo hasta el primer token, rendimiento, tiempo de pared, tasa de errores y costo con concurrencia realista.
Lo que los desarrolladores deben hacer antes del 12 de septiembre y cómo encaja CometAPI
Lista de verificación previa al lanzamiento
- Construya un conjunto de evaluación fijo a partir de flujos de trabajo reales de programación, investigación, ingeniería y agentes.
- Ejecútelo contra Grok 4.6 y registre tasa de éxito, reintentos, llamadas a herramientas, latencia, tokens y costo total.
- Mantenga la selección de modelo configurable y evite codificar un identificador provisional de Grok 4.7.
- Siga las notas de lanzamiento de xAI y la página del modelo de CometAPI para confirmar la disponibilidad.
- Después del lanzamiento, verifique contexto, modalidades, controles de razonamiento, precios, límites de tasa y alcance del despliegue.
- Reproduzca el mismo conjunto de evaluación antes de cambiar el tráfico de producción.
CometAPI proporciona una capa de API unificada para acceder a múltiples proveedores de modelos de IA a través de una sola cuenta y un patrón de integración. Una página de seguimiento de Grok 4.7 ya está disponible. CometAPI integrará Grok 4.7 tan pronto como xAI lo lance oficialmente y el acceso de producción esté disponible.
Hasta ese punto, trate cualquier identificador, precio o campo de capacidad previo al lanzamiento como provisional. Antes de enviar tráfico de producción, confirme que la ruta está activa, que una solicitud real tiene éxito, que el modelo devuelto es la versión prevista y que la estructura de precios actual es visible en la consola.
Perspectiva de precios de Grok 4.7 vs Grok 4.6
La tarifa estándar publicada de Grok 4.6 es de $2 por 1 millón de tokens de entrada y $6 por 1 millón de tokens de salida por debajo del umbral de contexto largo. Las notas de lanzamiento de xAI enumeran tarifas más altas para solicitudes por encima de 200,000 tokens de prompt. Los precios de Grok 4.7 no han sido anunciados oficialmente.
| Base de precios publicada | Entrada / 1M | Salida / 1M | Estado |
|---|---|---|---|
| Grok 4.6, prompt por debajo de 200K | $2 | $6 | Publicado |
| Grok 4.6, prompt por encima de 200K | $4 | $12 | Nivel de contexto largo publicado |
| Grok 4.7 | No anunciado | No anunciado | Confirmar tras el lanzamiento oficial |
Siguen siendo plausibles tres direcciones de precios: paridad con Grok 4.6 para acelerar la adopción, una capa premium si el costo de servicio es materialmente mayor o tarifas separadas por longitud de contexto y velocidad. Estos son escenarios de planificación, no una previsión de xAI.
Lista de verificación previa al lanzamiento
- Construya un conjunto de evaluación fijo a partir de flujos de trabajo reales de programación, investigación, ingeniería y agentes.
- Ejecútelo contra Grok 4.6 y registre tasa de éxito, reintentos, llamadas a herramientas, latencia, tokens y costo total.
- Mantenga la selección de modelo configurable y evite codificar un identificador provisional de Grok 4.7.
- Siga las notas de lanzamiento de xAI y la página del modelo de CometAPI para confirmar la disponibilidad.
- Después del lanzamiento, verifique contexto, modalidades, controles de razonamiento, precios, límites de tasa y alcance del despliegue.
- Reproduzca el mismo conjunto de evaluación antes de cambiar el tráfico de producción.
Grok 4.7: qué observar a continuación
Cuatro eventos convertirían la cuenta regresiva actual en un lanzamiento de producto verificable: una publicación oficial de lanzamiento de xAI; documentación del modelo que cubra contexto, modalidades y controles de razonamiento; precios finales del API e identificadores del modelo; y benchmarks o evaluaciones de producción reproducibles.
La pregunta de lanzamiento más útil no es si 2.1T suena grande. Es si Grok 4.7 completa tareas de ingeniería y de agentes difíciles con mayor fiabilidad—y a un mejor costo por resultado exitoso—que la línea base lanzada.
Preguntas frecuentes
¿Cuándo se espera el lanzamiento de Grok 4.7?
La cuenta regresiva de diez días del 2 de septiembre de Musk apunta aproximadamente al 12 de septiembre de 2026. Este es un objetivo inferido, no una fecha de calendario publicada por separado por xAI.
¿Grok 4.7 ya se lanzó?
Grok 4.7 ha sido objeto de teasers/anuncios públicos, pero aún no ha recibido un lanzamiento completo con documentación oficial de API/modelo.
¿Grok 4.7 es un modelo de 2.1 billones de parámetros?
Musk lo ha descrito como de aproximadamente 2.1T parámetros. xAI aún no ha publicado un documento de arquitectura que confirme parámetros activos o detalles de enrutamiento.
¿Grok 4.7 será mejor que Grok 4.6?
Musk ha afirmado una mejora sustancial, pero no existe una tabla de benchmarks oficial de Grok 4.7. Trate la afirmación como no verificada hasta que haya resultados reproducibles.
¿Grok 4.7 estará disponible a través de CometAPI?
Ya existe una página de seguimiento de CometAPI, pero la disponibilidad final, el identificador, los precios y los formatos compatibles deben confirmarse tras el lanzamiento oficial.
Conclusión
La historia de Grok 4.7 ha pasado de una estimación amplia de principios de septiembre a una cuenta regresiva concreta. La última declaración de Musk apunta aproximadamente al 12 de septiembre de 2026, mientras que publicaciones anteriores describen un modelo de aproximadamente 2.1T y entrenamiento suplementario con datos sustanciales de la empresa SpaceX.
Son señales previas al lanzamiento inusualmente específicas, pero no constituyen una model card, un conjunto de benchmarks ni un contrato de API. Los desarrolladores deben mantener Grok 4.6 como la línea base medible, preparar una evaluación controlada ahora y esperar a que xAI y CometAPI confirmen el acceso de producción antes de tomar decisiones de migración o presupuesto.
