Especificações técnicas do Gemini 3.6 Flash
| Item | Gemini 3.6 Flash |
|---|---|
| Fornecedor | Google DeepMind |
| ID do modelo | gemini-3.6-flash |
| Família do modelo | Gemini 3.x |
| Disponibilidade | Disponibilidade geral (GA) |
| Tipos de entrada | Texto, Imagem, Vídeo, Áudio, PDF |
| Tipos de saída | Texto |
| Janela de contexto | 1,048,576 tokens |
| Saída máxima | 65,536 tokens |
| Raciocínio | Com suporte (médio / alto) |
| Chamadas de função | Sim |
| Execução de código | Sim |
| Pesquisa de arquivos | Sim |
| Contexto de URL | Sim |
| Grounding de pesquisa | Sim |
| Uso de computador | Prévia |
| Saída estruturada | Sim |
| Cache | Com suporte |
Fonte: documentação da API do Google Gemini.
O que é o Gemini 3.6 Flash?
O Gemini 3.6 Flash é o mais novo modelo Flash da Google, pronto para produção, projetado para oferecer inteligência de ponta mantendo a baixa latência e a eficiência de custo pelas quais a série Flash é conhecida. Ele é otimizado para codificação, compreensão multimodal, raciocínio e fluxos de trabalho baseados em agentes.
Em comparação com o Gemini 3.5 Flash, o modelo melhora a qualidade de geração de código, a precisão de raciocínio, o uso de ferramentas e a eficiência de tokens, enquanto oferece suporte a uma janela de contexto massiva de 1 milhão de tokens. O Google o posiciona como o modelo de trabalho padrão para desenvolvedores que constroem agentes de IA e sistemas de automação complexos.
Principais recursos do Gemini 3.6 Flash
- Suporta processamento de contexto longo de 1M tokens.
- Entradas multimodais nativas, incluindo texto, imagens, vídeo, áudio e documentos PDF.
- Grandes melhorias na geração de código e em tarefas de engenharia de software.
- Suporte nativo a Function Calling, File Search, URL Context, Search Grounding e Computer Use.
- Mais eficiente em tokens do que o Gemini 3.5 Flash, reduzindo o custo de inferência enquanto mantém qualidade superior.
- Projetado para agentes de IA de múltiplas etapas e fluxos de trabalho autônomos.
Desempenho em benchmarks
O Google relata que o Gemini 3.6 Flash oferece desempenho superior em codificação, raciocínio e multimodalidade em comparação com o Gemini 3.5 Flash, usando significativamente menos tokens de saída. A empresa destaca o desempenho aprimorado em benchmarks internos de codificação e de agentes e afirma que o modelo pode reduzir o uso de tokens de saída em até 65% em determinadas avaliações de engenharia de software, como a DeepSWE, reduzindo os custos gerais de inferência. O Google não publicou tabelas públicas abrangentes de benchmarks (por exemplo, MMLU, GPQA, SWE-bench Verified) para este lançamento.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspecto | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Lançamento | 21 de julho de 2026 (GA) | Anterior em 2026 | ~fev. de 2026 (Prévia) |
| Posicionamento | Modelo robusto e eficiente para agentes, codificação e multimodalidade | Modelo Flash anterior voltado para agentes | Raciocínio avançado de nível Pro |
| Preços (por 1M de tokens) | Entrada: $1.50Saída: $7.50 | Entrada: $1.50Saída: $9.00 | Mais alto (por exemplo, ~$2 de entrada / $12 de saída) |
| Eficiência de tokens | 17% menos tokens de saída vs 3.5 Flash; menos etapas/chamadas de ferramentas | Base | Menos eficiente em fluxos de trabalho baseados em agentes |
| Velocidade | Alta (família Flash) | Alta | Mais lenta do que os modelos Flash |
| Janela de contexto | 1M tokens | 1M tokens | Provavelmente similar |
| Pontos fortes | Codificação, trabalho com conhecimento, multimodal (gráficos/documentos), uso de computador, eficiência em agentes | Bom equilíbrio entre agentes e codificação | Raciocínio mais profundo em problemas complexos |
Resumo rápido
- 3.6 Flash → Melhor escolha geral para a maioria dos usuários no momento: mais rápido, mais barato por tarefa, mais eficiente do que o 3.5 Flash e supera o 3.1 Pro em muitos benchmarks práticos/de agentes.
- 3.5 Flash → Antecessor sólido; ainda capaz, mas está sendo substituído pelo 3.6 Flash (custo de tokens de saída mais alto, menos eficiente).
- 3.1 Pro → Mais forte em alguns cenários de raciocínio profundo, porém mais lento, mais caro e geralmente fica atrás dos modelos Flash mais novos em velocidade, eficiência e muitas tarefas do mundo real/de agentes.
Limitações
- A geração de imagens não é suportada diretamente.
- A geração de áudio não está disponível.
- Computer Use permanece em Prévia.
- Alguns parâmetros legados de geração (
temperature,top_p,top_k) foram removidos da nova interface de API. - O melhor desempenho é alcançado por meio da API Gemini Interactions mais recente.
Como acessar a API do Gemini 3.6 Flash
Etapa 1: Obter acesso à API
Faça login no cometAPI. Se você ainda não for nosso usuário, registre-se primeiro. Acesse seu console do CometAPI. Obtenha a chave de API de credencial de acesso da interface. Clique em “Add Token” no token de API no centro pessoal, obtenha a chave do token: sk-xxxxx e envie.

Etapa 2: Enviar solicitações para a API do Gemini 3.6 Flash
Selecione o endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” para enviar a solicitação de API e defina o corpo da solicitação. O método e o corpo da solicitação são obtidos na documentação de API do nosso site. Nosso site também oferece teste no Apifox para sua conveniência. Substitua <YOUR_API_KEY> pela sua chave CometAPI real da sua conta. A URL base é Gemini Generating Content
Insira sua pergunta ou solicitação no campo content — é a isso que o modelo responderá. Processe a resposta da API para obter a resposta gerada.
Etapa 3: Processar respostas
A API retorna respostas de candidatos estruturadas, incluindo texto gerado, citações, metadados de segurança e saídas opcionais de ferramentas.