Especificações Técnicas do Gemini 3.6 Flash
| Item | Gemini 3.6 Flash |
|---|---|
| Fornecedor | Google DeepMind |
| Model ID | gemini-3.6-flash |
| Família do modelo | Gemini 3.x |
| Disponibilidade | General Availability (GA) |
| Tipos de entrada | Texto, Imagem, Vídeo, Áudio, PDF |
| Tipos de saída | Texto |
| Janela de contexto | 1.048.576 tokens |
| Saída máxima | 65.536 tokens |
| Raciocínio | Suportado (médio/alto) |
| Function calling | Yes |
| Code execution | Yes |
| File Search | Yes |
| URL Context | Yes |
| Search Grounding | Yes |
| Computer Use | Preview |
| Structured Output | Yes |
| Caching | Supported |
Fonte: documentação da API do Google Gemini.
O que é o Gemini 3.6 Flash?
O Gemini 3.6 Flash é o mais novo modelo da série Flash da Google, pronto para produção, projetado para oferecer inteligência de nível de ponta mantendo a baixa latência e a eficiência de custo pelas quais a série Flash é conhecida. Ele é otimizado para programação, compreensão multimodal, raciocínio e fluxos de trabalho orientados a agentes.
Em comparação com o Gemini 3.5 Flash, o modelo melhora a qualidade de geração de código, a precisão do raciocínio, o uso de ferramentas e a eficiência de tokens, além de oferecer suporte a uma enorme janela de contexto de 1 milhão de tokens. A Google o posiciona como o modelo padrão de trabalho para desenvolvedores que constroem agentes de IA e sistemas de automação complexos.
Principais Recursos do Gemini 3.6 Flash
- Suporta processamento de contexto longo de 1M-token.
- Entradas multimodais nativas, incluindo texto, imagens, vídeo, áudio e documentos PDF.
- Grandes melhorias em geração de código e tarefas de engenharia de software.
- Suporte nativo a Function Calling, File Search, URL Context, Search Grounding e Computer Use.
- Mais eficiente no uso de tokens do que o Gemini 3.5 Flash, reduzindo o custo de inferência ao mesmo tempo em que mantém qualidade superior.
- Projetado para agentes de IA de múltiplas etapas e fluxos de trabalho autônomos.
Desempenho em Benchmarks
A Google reporta que o Gemini 3.6 Flash oferece melhor desempenho em programação, raciocínio e multimodal do que o Gemini 3.5 Flash, usando significativamente menos tokens de saída. A empresa destaca desempenho aprimorado em benchmarks internos de programação e agentes e afirma que o modelo pode reduzir o uso de tokens de saída em até 65% em certas avaliações de engenharia de software, como a DeepSWE, diminuindo os custos gerais de inferência. O Google não publicou tabelas públicas abrangentes de benchmarks (por exemplo, MMLU, GPQA, SWE-bench Verified) para este lançamento.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspecto | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Lançamento | 21 de julho de 2026 (GA) | Início de 2026 | ~fev. de 2026 (Preview) |
| Posicionamento | Workhorse eficiente para agentes, programação, multimodal | Modelo Flash agêntico anterior | Raciocínio avançado do nível Pro |
| Preços (por 1M tokens) | Entrada: $1.50Saída: $7.50 | Entrada: $1.50Saída: $9.00 | Mais alto (p.ex., ~$2 entrada / $12 saída) |
| Eficiência de tokens | 17% menos tokens de saída vs 3.5 Flash; menos etapas/chamadas de ferramentas | Referência | Menos eficiente em fluxos orientados a agentes |
| Velocidade | Alta (família Flash) | Alta | Mais lento que os modelos Flash |
| Janela de contexto | 1M tokens | 1M tokens | Provavelmente similar |
| Pontos fortes | Programação, trabalho de conhecimento, multimodal (gráficos/documentos), computer use, eficiência em agentes | Bom equilíbrio agêntico/programação | Raciocínio mais profundo em problemas complexos |
Resumo rápido
- 3.6 Flash → Melhor escolha geral para a maioria dos usuários hoje: mais rápido, mais barato por tarefa, mais eficiente que o 3.5 Flash e supera o 3.1 Pro em muitos benchmarks práticos/agênticos.
- 3.5 Flash → Antecessor sólido; ainda capaz, mas está sendo substituído pelo 3.6 Flash (custo de tokens de saída mais alto, menos eficiente).
- 3.1 Pro → Mais forte em alguns cenários de raciocínio profundo, mas mais lento, mais caro e geralmente fica atrás dos modelos Flash mais novos em velocidade, eficiência e muitas tarefas reais/agênticas.
Limitações
- Geração de imagens não é suportada diretamente.
- Geração de áudio não está disponível.
- Computer Use permanece em Preview.
- Alguns parâmetros legados de geração (
temperature,top_p,top_k) foram removidos da nova interface da API. - O melhor desempenho é alcançado por meio da mais recente Gemini Interactions API.
Como acessar a API do Gemini 3.6 Flash
Etapa 1: Obter acesso à API
Faça login na cometAPI. Se você ainda não é nosso usuário, registre-se primeiro. Acesse seu console CometAPI. Obtenha a chave de API de credenciais de acesso da interface. Clique em “Add Token” no token de API no centro pessoal, obtenha a chave do token: sk-xxxxx e envie.

Etapa 2: Enviar solicitações para a API do Gemini 3.6 Flash
Selecione o endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” para enviar a solicitação de API e defina o corpo da requisição. O método de requisição e o corpo são obtidos na documentação da API do nosso site. Nosso site também oferece teste no Apifox para sua conveniência. Substitua <YOUR_API_KEY> pela sua chave CometAPI real da sua conta. a URL base é Geração de Conteúdo do Gemini
Insira sua pergunta ou solicitação no campo de conteúdo — é isso que o modelo responderá. Processe a resposta da API para obter a resposta gerada.
Etapa 3: Processar respostas
A API retorna respostas de candidatos estruturadas, incluindo texto gerado, citações, metadados de segurança e saídas opcionais de ferramentas.