Resumo
Grok 4.7 agora tem seu sinal de pré-lançamento mais claro: uma contagem regressiva de dez dias em 2 de setembro aponta para um lançamento esperado por volta de 12 de setembro de 2026. Declarações anteriores descreveram um modelo com aproximadamente 2,1 trilhões de parâmetros e treinamento suplementar usando uma quantidade substancial de dados da SpaceX. No entanto, a xAI ainda não publicou um model card do Grok 4.7, suíte de benchmarks, identificador final da API, janela de contexto ou preços oficiais. Até que esses detalhes apareçam, o Grok 4.6 lançado permanece como a referência de produção mensurável.
Principais pontos
- A data esperada de 12 de setembro é inferida da contagem regressiva de dez dias de Musk, não de um anúncio de calendário separado da xAI.
- As declarações sobre 2,1T e dados da SpaceX são afirmações de pré-lançamento; parâmetros ativos, roteamento, arquitetura e metodologia de treinamento permanecem não publicados.
- O Grok 4.6 já mostra resultados fortes em trabalho de conhecimento e orientados a agentes, incluindo 61,3% no FrontierCode v1.1 (Extended), mas fica atrás do modelo de comparação mais forte em várias avaliações difíceis de codificação.
- O Grok 4.7 deve ser avaliado pela taxa de tarefas aceitas, confiabilidade em longo horizonte, eficiência de tokens, latência e custo por resultado bem-sucedido — não apenas pela contagem de parâmetros.
- A CometAPI integrará o Grok 4.7 assim que a xAI lançar oficialmente o modelo e o endpoint de produção estiver disponível; os desenvolvedores ainda devem validar o ID do modelo ativo, o preço e o comportamento das respostas antes da migração.
O que é o Grok 4.7?
O Grok 4.7 é o sucessor anunciado do Grok 4.6 e deve continuar o foco da xAI em codificação, engenharia, agentes de longa duração e trabalho profissional de conhecimento. As evidências públicas atualmente consistem em declarações do fundador e uma contagem regressiva de lançamento, em vez de um pacote técnico completo.
A distinção mais importante é entre três objetos: o modelo Grok 4.7 anunciado, os sinais de pré-lançamento que descrevem seu possível porte e treinamento, e o Grok 4.6 de produção ativo. Os desenvolvedores devem tratar o Grok 4.7 como um candidato a avaliação futura até que a xAI publique documentação final e uma solicitação de produção tenha sucesso no endpoint lançado.
Data de lançamento e cronograma do Grok 4.7
Quando o Grok 4.7 deve ser lançado?
A declaração de Musk em 2 de setembro de que o modelo chegaria em dez dias aponta para aproximadamente 12 de setembro de 2026
Fonte: Elon Musk no X, 2 de setembro de 2026
Cronograma de lançamento do Grok 4.7
| Data | Sinal público | Interpretação |
|---|---|---|
| Fim de julho de 2026 | Musk descreveu um modelo de aproximadamente 2,1T, eficiência de tokens aprimorada e serviço um pouco mais lento. | Expectativas de porte e eficiência declaradas pelo fundador. |
| 12 de agosto de 2026 | O treinamento inicial foi descrito como concluído; o treinamento suplementar teria incluído dados substanciais da SpaceX. | Uma atualização do progresso do treinamento, não uma confirmação de lançamento. |
| 2 de setembro de 2026 | “Grok 4.7 sai em 10 dias.” | A contagem regressiva pública de lançamento mais clara até agora. |
| 12 de setembro de 2026 | Data de calendário derivada da contagem regressiva. | Alvo esperado; a disponibilidade final ainda requer um aviso de lançamento da xAI e um endpoint funcional. |
Especificações do Grok 4.7: informações confirmadas vs não confirmadas
A forma mais útil de ler as informações atuais do Grok 4.7 é separar declarações diretas do fundador de especificações que a xAI não publicou. A nova postagem confirma apenas o nome do modelo e uma contagem regressiva; não adiciona parâmetros técnicos ou resultados de benchmark.
| Especificação | Status atual do Grok 4.7 | Nível de evidência |
|---|---|---|
| Cronograma de lançamento | Por volta de 12 de setembro, inferido da contagem regressiva de 2 de setembro | Alvo declarado pelo fundador |
| Porte do modelo | Aproximadamente 2,1T de parâmetros | Declarado pelo fundador |
| Treinamento inicial | Descrito como concluído até 12 de agosto | Declarado pelo fundador |
| Treinamento suplementar | Inclui dados substanciais da empresa SpaceX | Declarado pelo fundador |
| Qualidade relativa | Alegado como significativamente melhor que o Grok 4.6 | Afirmativa não verificada |
| Eficiência de tokens | Alegada melhoria em relação ao Grok 4.6 | Afirmativa não verificada |
| Velocidade de serving | Espera-se que seja um pouco mais lenta | Declarado pelo fundador |
| Janela de contexto | Não publicada pela xAI | Desconhecido |
| Modalidades de E/S | Não publicadas pela xAI | Desconhecido |
| ID final do modelo na API | Não confirmado na documentação da xAI | Desconhecido |
| Preços oficiais | Não publicados pela xAI | Desconhecido |
| Benchmarks oficiais | Nenhum publicado para o Grok 4.7 | Desconhecido |
A afirmação de aproximadamente 2,1T de parâmetros não divulga parâmetros ativos, esparsidade, roteamento de especialistas, custo de inferência ou cômputo de treinamento efetivo. A contagem de parâmetros sozinha não estabelece qualidade em produção.
Por que o sinal de treinamento com SpaceX pode importar mais do que 2,1T
A divulgação mais consequente pode ser o suplemento com dados da SpaceX. Um corpus de engenharia de alta qualidade pode melhorar o raciocínio técnico, design, depuração, otimização e o trabalho de agentes de longo horizonte, onde a distribuição de tarefas e a qualidade do pós-treinamento muitas vezes importam mais do que o porte bruto.
Essa direção é consistente com a estratégia de modelos lançados da xAI. O relatório de treinamento do Grok 4.6 descreve uma execução suplementar mais longa com dados de engenharia de alta qualidade, seguida por ajuste supervisionado e aprendizado por reforço em codificação, STEM, desenvolvimento web, otimização de kernel e design auxiliado por computador.
Isso torna a alegação do Grok 4.7 tecnicamente plausível, não comprovada. Uma vantagem real deve se tornar visível após o lançamento em testes de engenharia reprodutíveis, taxas de conclusão de tarefas, latência e custo por resultado bem-sucedido.
Desempenho Grok 4.7 vs Grok 4.6: o que a referência mostra
Ainda não existem pontuações oficiais do Grok 4.7. O ponto de comparação responsável é a avaliação do Grok 4.6 lançada pela xAI. A visão geral completa do modelo aparece no deep dive do Grok 4.6 da CometAPI; a tabela abaixo mantém apenas as linhas de benchmark mais relevantes para decisão.
| Avaliação oficial | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9% | 66,7% | 67,2% | 70,5% |
| DeepSWE v1.1 | 65,9% | 54,0% | 73,0% | 70,0% |
| FrontierCode v1.1 (Extended) | 61,3% | 56,6% | 60,6% | 63,6% |
| Terminal-Bench v3.0 | 26,0% | 15,7% | 34,6% | 34,1% |
Resultado de referência: O Grok 4.6 demonstra uma vantagem real sobre o Grok 4.5 em todas as linhas mostradas. Ele iguala o GPT-5.6 Sol no índice geral de inteligência, lidera este grupo no GDPVal-AA v2 e supera o GPT-5.6 Sol no FrontierCode. Suas principais lacunas publicadas continuam sendo DeepSWE e Terminal-Bench.
Esses resultados estabelecem um padrão concreto para o Grok 4.7. Se o modelo maior e o treinamento suplementar orientado à engenharia se transferirem para produção, o avanço esperado seria uma codificação em nível de repositório mais forte e conclusão de tarefas de terminal sem perder a força do Grok 4.6 em trabalho de conhecimento. Uma meta ambiciosa crível é tornar-se competitivo com o Claude Fable 5.1 lançado em fluxos de trabalho de codificação e agentes de longa duração. Isso é uma previsão a ser testada, não uma alegação de benchmark atual.
Grok 4.7 vs Grok 4.6: avanços esperados e orientação de upgrade
Os sinais vazados e declarados pelo fundador sugerem cinco áreas onde o Grok 4.7 pode melhorar. Como a xAI não publicou dados finais de avaliação, cada expectativa deve ser convertida em um teste de aceitação mensurável.
Codificação em nível de repositório
O Grok 4.6 já é forte no CursorBench e no FrontierCode, mas seus resultados em DeepSWE e Terminal-Bench deixam espaço visível para melhoria. O Grok 4.7 deve demonstrar maior aceitação de patches, menos regressões e melhor recuperação na linha de comando nos mesmos repositórios antes de substituir o 4.6.
Confiabilidade de agentes de longo horizonte
O sinal de dados da SpaceX e a direção de treinamento de agentes já existente da xAI sugerem foco em trabalhos de engenharia multiestágio. Meça fluxos de trabalho concluídos, falhas em chamadas de ferramentas, novas tentativas, intervenções humanas e recuperação após erros — não apenas a qualidade do texto final.
Trabalho de conhecimento e raciocínio técnico
O Grok 4.6 já lidera o conjunto de comparação no GDPVal-AA v2. O Grok 4.7 deve preservar essa vantagem enquanto melhora a transferência para revisões de design, síntese de pesquisa, depuração, otimização e outras tarefas técnicas complexas.
Eficiência de tokens
Um modelo maior ainda pode ser mais barato por tarefa bem-sucedida se atingir resultados corretos em menos etapas. Compare tokens de entrada totais, entrada em cache, tokens de saída, novas tentativas e custo para o mesmo resultado aceito.
Trade-offs de serving
Se o Grok 4.7 for mais lento, os ganhos de qualidade precisam superar a latência. Registre tempo até o primeiro token, vazão sustentada, tempo de parede para concluir a tarefa, taxa de erro e custo sob concorrência realista.
Benchmarks do Grok 4.7: 5 testes para verificar uma atualização real sobre o Grok 4.6
- Sucesso em engenharia de software: medir issues resolvidos, testes aprovados, taxa de regressão e aceitação de patches em repositórios representativos.
- Confiabilidade de agentes de longo horizonte: rastrear fluxos concluídos, falhas de chamada de ferramentas, novas tentativas, recuperação e intervenções humanas em execuções multiestágio.
- Transferência para engenharia no mundo real: testar design, depuração, otimização, raciocínio científico e tarefas relacionadas a CAD com critérios de avaliação divulgados.
- Eficiência de tokens por tarefa bem-sucedida: comparar tokens totais e gasto necessários para atingir o mesmo resultado aceito.
- Latência e custo sob carga de produção: avaliar tempo até o primeiro token, vazão, tempo de parede, taxa de erro e custo com concorrência realista.
O que os desenvolvedores devem fazer antes de 12 de setembro — e como a CometAPI se encaixa
Checklist pré-lançamento para desenvolvedores
- Construir um conjunto de avaliação fixo a partir de fluxos reais de codificação, pesquisa, engenharia e agentes.
- Executá-lo no Grok 4.6 e registrar taxa de sucesso, novas tentativas, chamadas de ferramentas, latência, tokens e custo total.
- Manter a seleção de modelo configurável e evitar codificar um identificador provisório do Grok 4.7.
- Acompanhar as notas de lançamento da xAI e a página do modelo na CometAPI para disponibilidade confirmada.
- Após o lançamento, verificar contexto, modalidades, controles de raciocínio, preços, limites de taxa e escopo de implantação.
- Reexecutar o mesmo conjunto de avaliação antes de transferir tráfego de produção.
A CometAPI fornece uma camada de API unificada para acessar vários provedores de modelos de IA por meio de uma única conta e padrão de integração. Uma página de acompanhamento do Grok 4.7 já está disponível. A CometAPI integrará o Grok 4.7 assim que a xAI o lançar oficialmente e o acesso de produção estiver disponível.
Até lá, trate qualquer identificador, preço ou campo de capacidade de pré-lançamento como provisório. Antes de enviar tráfego de produção, confirme que a rota está ativa, que uma solicitação real tem sucesso, que o modelo retornado é a versão pretendida e que o preço atual está visível no console.
Perspectiva de preços do Grok 4.7 vs Grok 4.6
A tarifa padrão publicada do Grok 4.6 é de US$ 2 por 1 milhão de tokens de entrada e US$ 6 por 1 milhão de tokens de saída abaixo do limite de longo contexto. As notas de lançamento da xAI listam tarifas mais altas para solicitações acima de 200.000 tokens de prompt. Os preços do Grok 4.7 ainda não foram oficialmente anunciados.
| Base de preço publicada | Entrada / 1M | Saída / 1M | Status |
|---|---|---|---|
| Grok 4.6, prompt abaixo de 200K | US$ 2 | US$ 6 | Publicado |
| Grok 4.6, prompt acima de 200K | US$ 4 | US$ 12 | Camada de longo contexto publicada |
| Grok 4.7 | Não anunciado | Não anunciado | Confirmar após o lançamento oficial |
Três direções de preço permanecem plausíveis: paridade com o Grok 4.6 para acelerar a adoção, uma camada premium se o custo de serving for materialmente maior ou tarifas separadas por comprimento de contexto e velocidade. São cenários de planejamento, não uma previsão da xAI.
Checklist pré-lançamento para desenvolvedores
- Construir um conjunto de avaliação fixo a partir de fluxos reais de codificação, pesquisa, engenharia e agentes.
- Executá-lo no Grok 4.6 e registrar taxa de sucesso, novas tentativas, chamadas de ferramentas, latência, tokens e custo total.
- Manter a seleção de modelo configurável e evitar codificar um identificador provisório do Grok 4.7.
- Acompanhar as notas de lançamento da xAI e a página do modelo na CometAPI para disponibilidade confirmada.
- Após o lançamento, verificar contexto, modalidades, controles de raciocínio, preços, limites de taxa e escopo de implantação.
- Reexecutar o mesmo conjunto de avaliação antes de transferir tráfego de produção.
Grok 4.7: o que observar a seguir
Quatro eventos transformariam a contagem regressiva atual em um lançamento de produto verificável: um post oficial de lançamento da xAI; documentação do modelo cobrindo contexto, modalidades e controles de raciocínio; preços finais da API e identificadores de modelo; e benchmarks reprodutíveis ou avaliações em produção.
A pergunta de lançamento mais útil não é se 2,1T parece grande. É se o Grok 4.7 conclui tarefas difíceis de engenharia e de agentes com mais confiabilidade — e a um custo melhor por resultado bem-sucedido — do que a referência lançada.
FAQ
Quando o Grok 4.7 deve ser lançado?
A contagem regressiva de dez dias em 2 de setembro de Musk aponta para aproximadamente 12 de setembro de 2026. Este é um alvo inferido, não uma data de calendário publicada separadamente pela xAI.
O Grok 4.7 já foi lançado?
O Grok 4.7 foi provocativamente divulgado/anunciado publicamente, mas ainda não recebeu uma liberação completa de documentação oficial da API/modelo.
O Grok 4.7 é um modelo de 2,1 trilhões de parâmetros?
Musk o descreveu como tendo aproximadamente 2,1T de parâmetros. A xAI ainda não publicou um documento de arquitetura confirmando parâmetros ativos ou detalhes de roteamento.
O Grok 4.7 será melhor que o Grok 4.6?
Musk afirmou uma melhoria substancial, mas não existe uma tabela oficial de benchmarks do Grok 4.7. Trate a afirmação como não verificada até que resultados reprodutíveis estejam disponíveis.
O Grok 4.7 estará disponível via CometAPI?
Já existe uma página de acompanhamento na CometAPI, mas a disponibilidade final, identificador, preços e formatos suportados devem ser confirmados após o lançamento oficial.
Conclusão
A história do Grok 4.7 passou de uma estimativa ampla para o início de setembro a uma contagem regressiva concreta. A declaração mais recente de Musk aponta para aproximadamente 12 de setembro de 2026, enquanto postagens anteriores descrevem um modelo de cerca de 2,1T e treinamento suplementar com dados substanciais da SpaceX.
Esses são sinais de pré-lançamento incomumente específicos, mas não são um model card, uma suíte de benchmarks ou um contrato de API. Os desenvolvedores devem manter o Grok 4.6 como referência mensurável, preparar agora uma avaliação controlada e esperar a confirmação de acesso de produção pela xAI e pela CometAPI antes de tomar decisões de migração ou orçamento.
