Especificaciones técnicas de Gemini 3.6 Flash
| Elemento | Gemini 3.6 Flash |
|---|---|
| Proveedor | Google DeepMind |
| ID del modelo | gemini-3.6-flash |
| Familia de modelo | Gemini 3.x |
| Disponibilidad | Disponibilidad general (GA) |
| Tipos de entrada | Texto, Imagen, Video, Audio, PDF |
| Tipos de salida | Texto |
| Ventana de contexto | 1,048,576 tokens |
| Salida máxima | 65,536 tokens |
| Razonamiento | Compatible (medio / alto) |
| Llamadas a funciones | Sí |
| Ejecución de código | Sí |
| Búsqueda de archivos | Sí |
| Contexto de URL | Sí |
| Grounding de búsqueda | Sí |
| Uso de la computadora | Vista previa |
| Salida estructurada | Sí |
| Caché | Compatible |
Fuente: Documentación de la API de Google Gemini.
¿Qué es Gemini 3.6 Flash?
Gemini 3.6 Flash es el modelo Flash de producción más nuevo de Google, diseñado para ofrecer inteligencia de vanguardia manteniendo la baja latencia y la eficiencia de costos por la que es conocida la serie Flash. Está optimizado para programación, comprensión multimodal, razonamiento y flujos de trabajo basados en agentes.
En comparación con Gemini 3.5 Flash, el modelo mejora la calidad de generación de código, la precisión del razonamiento, el uso de herramientas y la eficiencia de tokens, al tiempo que admite una enorme ventana de contexto de 1 millón de tokens. Google lo posiciona como el modelo caballo de batalla predeterminado para desarrolladores que crean agentes de IA y sistemas de automatización complejos.
Características principales de Gemini 3.6 Flash
- Admite procesamiento de contexto largo de 1M tokens.
- Entradas multimodales nativas, incluidas texto, imágenes, video, audio y documentos PDF.
- Grandes mejoras en generación de código y tareas de ingeniería de software.
- Compatibilidad integrada con Llamadas a funciones, Búsqueda de archivos, Contexto de URL, Grounding de búsqueda y Uso de la computadora.
- Más eficiente en tokens que Gemini 3.5 Flash, reduciendo el costo de inferencia y manteniendo mayor calidad.
- Diseñado para agentes de IA de múltiples pasos y flujos de trabajo autónomos.
Rendimiento en benchmarks
Google informa que Gemini 3.6 Flash ofrece un rendimiento más sólido en programación, razonamiento y multimodalidad que Gemini 3.5 Flash utilizando significativamente menos tokens de salida. La compañía destaca el rendimiento mejorado en benchmarks internos de programación y agentes, y afirma que el modelo puede reducir el uso de tokens de salida hasta en 65% en ciertas evaluaciones de ingeniería de software como DeepSWE, lo que disminuye los costos generales de inferencia. Google no ha publicado tablas públicas completas de benchmarks (p. ej., MMLU, GPQA, SWE-bench Verified) para este lanzamiento.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspecto | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Lanzamiento | 21 de julio de 2026 (GA) | Principios de 2026 | ~feb. de 2026 (Vista previa) |
| Posicionamiento | Caballo de batalla eficiente para agentes, programación y multimodalidad | Modelo Flash orientado a agentes anterior | Razonamiento avanzado de nivel Pro |
| Precio (por 1M tokens) | Entrada: $1.50Salida: $7.50 | Entrada: $1.50Salida: $9.00 | Más alto (p. ej., ~$2 entrada / $12 salida) |
| Eficiencia de tokens | 17% menos tokens de salida vs 3.5 Flash; menos pasos/llamadas a herramientas | Referencia | Menos eficiente en flujos agentic |
| Velocidad | Alta (familia Flash) | Alta | Más lenta que los modelos Flash |
| Ventana de contexto | 1M tokens | 1M tokens | Probablemente similar |
| Fortalezas | Programación, trabajo de conocimiento, multimodal (gráficos/documentos), uso de la computadora, eficiencia agéntica | Buen equilibrio entre agentes y programación | Razonamiento más profundo en problemas complejos |
Resumen rápido
- 3.6 Flash → Mejor opción general para la mayoría de usuarios ahora: más rápido, más barato por tarea, más eficiente que 3.5 Flash y supera a 3.1 Pro en muchos benchmarks prácticos/agénticos.
- 3.5 Flash → Predecesor sólido; sigue siendo capaz pero está siendo sustituido por 3.6 Flash (mayor costo de tokens de salida, menos eficiente).
- 3.1 Pro → Más fuerte en algunos escenarios de razonamiento profundo, pero más lento, más caro y generalmente por detrás de los modelos Flash más nuevos en velocidad, eficiencia y muchas tareas reales/agénticas.
Limitaciones
- La generación de imágenes no está admitida directamente.
- La generación de audio no está disponible.
- Uso de la computadora permanece en Vista previa.
- Algunos parámetros heredados de generación (
temperature,top_p,top_k) se han eliminado de la nueva interfaz de la API. - El mejor rendimiento se consigue a través de la última API de Gemini Interactions.
Cómo acceder a la API de Gemini 3.6 Flash
Paso 1: Obtener acceso a la API
Inicia sesión en cometAPI. Si aún no eres usuario, regístrate primero. Inicia sesión en tu CometAPI console. Obtén la clave de API de credenciales de acceso de la interfaz. Haz clic en “Add Token” en el token de API en el centro personal, obtén la clave de token: sk-xxxxx y envía.

Paso 2: Enviar solicitudes a la API de Gemini 3.6 Flash
Selecciona el endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” para enviar la solicitud de API y configura el cuerpo de la solicitud. El método y el cuerpo de la solicitud se obtienen de la documentación de la API de nuestro sitio web. Nuestro sitio web también proporciona prueba en Apifox para tu comodidad. Reemplaza <YOUR_API_KEY> con tu clave real de CometAPI de tu cuenta. La URL base es Gemini Generating Content
Inserta tu pregunta o solicitud en el campo content—esto es a lo que responderá el modelo. Procesa la respuesta de la API para obtener la respuesta generada.
Paso 3: Procesar respuestas
La API devuelve respuestas de candidatos estructuradas que incluyen texto generado, citas, metadatos de seguridad y salidas opcionales de herramientas.