Especificações técnicas — Gemini 3.1 Pro
| Item | gemini-3-pro (resumo público) |
|---|---|
| Fornecedor | |
| ID de modelo canônico | gemini-3-pro (prévia pública) |
| Tipos de entrada | Texto, Imagem, Vídeo, Áudio, PDF |
| Tipos de saída | Texto (linguagem natural, saídas estruturadas, cargas de chamada de função) |
| Limite de tokens de entrada (contexto) | 1.048.576 tokens |
| Limite de tokens de saída | 65.536 tokens |
| Chamada de funções / uso de ferramentas | Suportado (chamada de funções, saídas estruturadas, integrações de ferramentas) |
| Multimodalidade | Suporte multimodal completo (imagens, vídeo, áudio, documentos) |
| Execução de código e fluxos com agentes | Suportado (modo agente, assistência de código, orquestração de ferramentas) |
| Corte de conhecimento | janeiro de 2025 |
O que é o Gemini 3.1 Pro?
O Gemini 3.1 Pro é o carro-chefe público da Google na família Gemini 3, posicionado como um modelo multimodal de raciocínio de última geração com ferramentas avançadas para agentes e desenvolvedores. O modelo enfatiza o manuseio de contexto de alta capacidade (entradas de mais de 1M tokens), amplo suporte a mídias (imagens, vídeo, áudio, PDF) e integrações profundas para uso de ferramentas, chamadas de função e fluxos de trabalho centrados em código (por exemplo, Gemini Code Assist e modos de agente).
O Gemini 3 Pro é apresentado pela Google como otimizado tanto para experiências interativas de desenvolvedor (codificação de baixa latência e fluxos de trabalho com agentes) quanto para compreensão multimodal de alta fidelidade (interpretação e raciocínio em entradas de mídias mistas).
Principais recursos do Gemini 3.1 Pro
O Gemini-3.1 Pro (em sua prévia) introduz os seguintes recursos:
Integração multimodal
Processa entradas em:
- Linguagem natural
- Imagens
- Fala/áudio
- Vídeo
com uma representação unificada de tokens para raciocínio entre modalidades.
Janela de contexto estendida
Uma capacidade de contexto excepcionalmente grande, de até ~1 milhão de tokens, possibilita o tratamento de:
- Documentos longos
- Síntese de múltiplos documentos
- Bases de código e transcrições.
Isso supera muitos modelos concorrentes que normalmente oferecem suporte a ~32 K–262 K tokens.
Escalonamento com Mixture-of-Experts (MoE) esparso
O roteamento MoE esparso permite escalar a capacidade interna do modelo sem custos computacionais proporcionais, melhorando o raciocínio em escala.
Raciocínio/planejamento avançado
Inovações como treinamento de cadeia de raciocínio, aprendizado por reforço com feedback humano e benchmarks especializados tornam-no forte em tarefas lógicas e matemáticas.
Supostos benchmarks:
AIME 2025: 100% (com execução de código)
SWE-Bench Verified: 83,9%
ARC-AGI-2: 71,8%
LiveCodeBench Pro: 2844 Elo
Terminal-Bench 2.0: 63,5%
MMMLU: 93,6%
Casos de uso empresariais representativos
- Pipelines de mídia ponta a ponta: Ingerir vídeo, transcrições e imagens para produzir resumos sincronizados, metadados e insights estruturados em escala.
- Geração e revisão de código em larga escala: Uso em IDEs e pipelines de CI para gerar código automaticamente, refatorar projetos multi-arquivo e produzir sugestões de testes em grandes bases de código.
- Automação com agentes: Coordenar agentes com múltiplas ferramentas que interagem com serviços de nuvem, sistemas de orquestração e APIs internas usando chamadas de função estruturadas.
- Pesquisa e produção de conteúdo: Redigir conteúdo de formato longo (relatórios, livros) que combine texto e multimídia incorporada, preservando referências cruzadas internas.
Como acessar a API do Gemini 3.1 Pro
Etapa 1: Cadastre-se para obter uma chave de API
Faça login em cometapi.com. Se você ainda não é nosso usuário, registre-se primeiro. Acesse seu console do CometAPI. Obtenha a credencial de acesso (chave de API) da interface. Clique em “Add Token” no token de API no centro pessoal, obtenha a chave do token: sk-xxxxx e envie.
Etapa 2: Envie solicitações para a API do Gemini 3.1 Pro
Selecione o endpoint “gemini-3.1-pro” para enviar a solicitação de API e defina o corpo da solicitação. O método e o corpo da solicitação são obtidos na nossa documentação de API no site. Nosso site também fornece teste no Apifox para sua conveniência. Substitua <YOUR_API_KEY> pela sua chave real do CometAPI da sua conta. O URL base é Gemini Generating Content e Chat.
Insira sua pergunta ou solicitação no campo content — é a isso que o modelo responderá. Procese a resposta da API para obter a resposta gerada.
Etapa 3: Recuperar e verificar os resultados
Procese a resposta da API para obter a resposta gerada. Após o processamento, a API responde com o status da tarefa e os dados de saída.
Veja também Gemini 3 Pro API