Especificações técnicas do Grok 4.6
| Item | Grok 4.6 |
|---|---|
| Provider | xAI |
| Model ID | grok-4.6 |
| Model type | Modelo de fronteira multimodal de raciocínio e agentivo |
| Primary strengths | Agentes de longa duração, programação, trabalho de conhecimento, criação de apps interativas/visuais |
| Input modalities | Texto e imagens |
| Output modality | Texto |
| Context window | 500,000 tokens |
| Knowledge cutoff | 1 de fevereiro de 2026 |
| Output limit | Nenhum limite de saída de texto publicado pela xAI |
| Reasoning | low, medium, high (padrão), xhigh |
| APIs | Responses API, Chat Completions |
| Tools | Chamada de função, web search, X search, execução de código |
| API pricing | $2 / 1M tokens de entrada; $6 / 1M tokens de saída |
| Fast variant | Disponível por 2× o preço padrão |
| Released | 12 de agosto de 2026 |
O que é o Grok 4.6?
Grok 4.6 é o mais novo modelo de fronteira da xAI com foco em inteligência agentiva.
A diferença em relação a um chatbot tradicional é importante.
A xAI enfatiza a capacidade do modelo de se manter em projetos complexos por mais tempo, trabalhar em vários codebases, pesquisar tópicos desconhecidos, criar aplicações e verificar o próprio trabalho.
Isso torna o Grok 4.6 particularmente relevante para o mercado em rápida expansão de agentes de programação de IA e agentes autônomos.
Principais recursos do Grok 4.6
- Execução de agentes de longa duração: O Grok 4.6 é treinado para sustentar trabalhos complexos ao longo de muitas etapas, em vez de otimizar apenas para respostas de turno único.
- Programação agentiva: Ele mira engenharia de software em nível de repositório, geração de código, depuração, testes iterativos e ambientes de programação específicos de domínio.
- Pesquisa para trabalho do conhecimento: O modelo pode pesquisar domínios desconhecidos, organizar informações, raciocinar sobre requisitos complexos e transformar descobertas em um entregável concreto.
- Criação de aplicações visuais e interativas: A xAI relata resultados iniciais mais fortes para projetos visuais e interativos, incluindo transformar uma ideia de produto em uma aplicação funcional e refiná-la por meio de ciclos de feedback.
- Autoavaliação e verificação: Em trajetórias mais longas, a xAI observou mais comportamentos em que o modelo verifica o próprio trabalho antes de continuar.
- Uso nativo de ferramentas: O Grok 4.6 suporta chamadas de função, web search, X search e execução de código pela API.
- Raciocínio configurável: Os desenvolvedores podem escolher o esforço de raciocínio
low,medium,highouxhigh, tornando o modelo adaptável a workloads sensíveis à latência e de raciocínio profundo.
Desempenho em benchmarks do Grok 4.6
A xAI relata que o Grok 4.6 iguala o GPT-5.6 Sol no Artificial Analysis Intelligence Index, um composto de nove benchmarks. Seus resultados publicados mais fortes incluem:
| Benchmark | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
Esses números vêm do anúncio de lançamento da xAI de 12 de agosto. A xAI observa que números de terceiros são extraídos de cartões de sistema do desenvolvedor ou de leaderboards públicos de benchmarks, portanto os resultados entre modelos devem ser interpretados levando em conta a metodologia de avaliação e as configurações do modelo.
Grok 4.6 vs Grok 4.5 vs GPT-5.6 Sol vs Claude Fable 5
| Model | Primary positioning | Context | AA Intelligence | Coding/agentic profile |
|---|---|---|---|---|
| Grok 4.6 | Agentes de longa duração, programação, trabalho de conhecimento | 500K | 61 | Programação agentiva sólida e fluxos de trabalho de projetos interativos |
| Grok 4.5 | Generalista de fronteira rápido e modelo de programação | 500K | 56 | Forte baseline para programação e fluxos de trabalho de agentes |
| GPT-5.6 Sol | Raciocínio geral de fronteira e trabalho agentivo | O contexto publicado do concorrente varia por implantação | 61 | Fortes resultados em DeepSWE e Terminal-Bench |
| Claude Fable 5 | Trabalho do conhecimento e programação de fronteira | O contexto publicado do concorrente varia por implantação | 62 | Muito forte em CursorBench, FrontierCode, APEX-SWE |
O Grok 4.6 é mais atraente quando o workload exige execução sustentada em vez de uma única resposta de alta qualidade. É especialmente interessante para desenvolvedores que constroem agentes que pesquisam repetidamente, chamam ferramentas, editam código, testam resultados e continuam a partir do contexto acumulado. O Claude Fable 5 mantém uma vantagem em vários benchmarks publicados de programação e agentes, enquanto o GPT-5.6 Sol supera o Grok 4.6 em DeepSWE e Terminal-Bench na comparação da xAI.
Limitações e considerações
- Os resultados de benchmarks dependem da tarefa: O Grok 4.6 não é uniformemente o modelo com maior pontuação. Seus resultados publicados mostram forças e fraquezas claras em diferentes avaliações agentivas.
- Workloads de longa duração podem consumir muitos tokens: Uma grande janela de contexto e o uso iterativo de ferramentas podem aumentar o consumo total de inferência, mesmo quando o preço por token é competitivo.
- A configuração das ferramentas importa: Web search, X search, execução de código e chamadas de função exigem uma arquitetura de aplicação que possa lidar com segurança com permissões de ferramentas e dados retornados.
- Data de corte do conhecimento: A data de corte documentada é 1 de fevereiro de 2026. Para informações mais novas, os desenvolvedores devem usar ferramentas apropriadas de recuperação ou pesquisa na web, em vez de confiar no conhecimento estático do modelo.
- Caching requer configuração deliberada: A xAI recomenda
prompt_cache_keypara a Responses API ex-grok-conv-idpara Chat Completions para melhorar a confiabilidade de acertos de cache.
Casos de uso do Grok 4.6
- Agentes autônomos de programação — análise de repositório, implementação, depuração, testes e correções iterativas.
- Prototipagem de produto — transformar requisitos amplos de produto em aplicações interativas funcionais.
- Agentes de pesquisa técnica — pesquisar domínios técnicos desconhecidos e produzir entregáveis estruturados.
- Copilotos de desenvolvedor — geração de código, revisão, depuração e fluxos de trabalho de desenvolvimento em múltiplas etapas.
- Automação do trabalho do conhecimento — análise de documentos, síntese de informações, planejamento e geração de saídas estruturadas.
- Assistentes que usam ferramentas — aplicações que combinam raciocínio do modelo com web search, X search, execução de código e chamadas de função personalizadas.
Como acessar a API do Grok 4.6
Para aplicações que já usam a camada de API unificada da CometAPI, use o ID de modelo do Grok 4.6 exposto pela CometAPI e siga o endpoint/esquema atual na documentação da API da CometAPI. Isso pode reduzir o trabalho de integração específico do provedor quando uma aplicação precisa alternar entre LLMs de fronteira.
Um fluxo de trabalho típico é:
- Crie ou acesse uma conta na CometAPI.
- Crie um token de API no console da CometAPI.
- Selecione o endpoint do modelo
grok-4.6. - Envie requisições pelo endpoint da CometAPI usando o esquema de requisição documentado para o modelo.
- Processe o texto retornado, as chamadas de ferramenta ou a saída estruturada na sua aplicação.