Especificaciones técnicas de Gemini 3.6 Flash
| Elemento | Gemini 3.6 Flash |
|---|---|
| Proveedor | Google DeepMind |
| ID del modelo | gemini-3.6-flash |
| Familia de modelo | Gemini 3.x |
| Disponibilidad | Disponibilidad general (GA) |
| Tipos de entrada | Texto, Imagen, Video, Audio, PDF |
| Tipos de salida | Texto |
| Ventana de contexto | 1,048,576 tokens |
| Salida máxima | 65,536 tokens |
| Pensamiento | Compatible (medio / alto) |
| Llamadas a funciones | Sí |
| Ejecución de código | Sí |
| Búsqueda de archivos | Sí |
| Contexto de URL | Sí |
| Grounding de búsqueda | Sí |
| Computer Use | Vista previa |
| Salida estructurada | Sí |
| Caché | Compatible |
Fuente: Documentación de la API de Google Gemini.
¿Qué es Gemini 3.6 Flash?
Gemini 3.6 Flash es el modelo Flash de producción más reciente de Google, diseñado para ofrecer inteligencia de frontera manteniendo la baja latencia y la rentabilidad por las que se conoce la serie Flash. Está optimizado para programación, comprensión multimodal, razonamiento y flujos de trabajo con agentes.
En comparación con Gemini 3.5 Flash, el modelo mejora la calidad de generación de código, la precisión de razonamiento, el uso de herramientas y la eficiencia de tokens, además de admitir una ventana de contexto masiva de 1 millón de tokens. Google lo posiciona como el modelo de referencia predeterminado para desarrolladores que construyen agentes de IA y sistemas de automatización complejos.
Características principales de Gemini 3.6 Flash
- Admite procesamiento de contexto largo de 1M tokens.
- Entradas multimodales nativas, incluidos texto, imágenes, video, audio y documentos PDF.
- Importantes mejoras en generación de código y tareas de ingeniería de software.
- Compatibilidad integrada con Function Calling, File Search, URL Context, Search Grounding y Computer Use.
- Más eficiente en tokens que Gemini 3.5 Flash, reduciendo el costo de inferencia y manteniendo mayor calidad.
- Diseñado para agentes de IA multi-paso y flujos de trabajo autónomos.
Rendimiento en benchmarks
Google informa que Gemini 3.6 Flash ofrece un rendimiento superior en programación, razonamiento y multimodal frente a Gemini 3.5 Flash, mientras usa significativamente menos tokens de salida. La compañía destaca un mejor desempeño en benchmarks internos de programación y de agentes, y afirma que el modelo puede reducir el uso de tokens de salida hasta en 65% en ciertas evaluaciones de ingeniería de software como DeepSWE, disminuyendo los costos generales de inferencia. Google no ha publicado tablas públicas integrales de benchmarks (p. ej., MMLU, GPQA, SWE-bench Verified) para este lanzamiento.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspecto | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Lanzamiento | 21 de julio de 2026 (GA) | 2026 anterior | ~feb. de 2026 (Vista previa) |
| Posicionamiento | Caballo de batalla eficiente para agentes, programación y multimodal | Modelo Flash agéntico previo | Razonamiento avanzado de nivel Pro |
| Precio (por 1M tokens) | Entrada: $1.50Salida: $7.50 | Entrada: $1.50Salida: $9.00 | Más alto (p. ej., ~$2 entrada / $12 salida) |
| Eficiencia de tokens | 17% menos tokens de salida vs 3.5 Flash; menos pasos/llamadas a herramientas | Base | Menos eficiente en flujos con agentes |
| Velocidad | Alta (familia Flash) | Alta | Más lenta que los modelos Flash |
| Ventana de contexto | 1M tokens | 1M tokens | Probablemente similar |
| Fortalezas | Programación, trabajo de conocimiento, multimodal (gráficos/documentos), uso de computadora, eficiencia con agentes | Buen equilibrio agéntico/programación | Razonamiento más profundo en problemas complejos |
Resumen rápido
- 3.6 Flash → La mejor opción general para la mayoría de usuarios ahora: más rápido, más barato por tarea, más eficiente que 3.5 Flash y supera a 3.1 Pro en muchos benchmarks prácticos/con agentes.
- 3.5 Flash → Sólido predecesor; sigue siendo capaz pero está siendo reemplazado por 3.6 Flash (mayor costo por token de salida, menos eficiente).
- 3.1 Pro → Más fuerte en algunos escenarios de razonamiento profundo, pero más lento, más caro y generalmente por detrás de los modelos Flash más nuevos en velocidad, eficiencia y muchas tareas reales/con agentes.
Limitaciones
- La generación de imágenes no está admitida directamente.
- La generación de audio no está disponible.
- Computer Use permanece en Vista previa.
- Algunos parámetros heredados de generación (
temperature,top_p,top_k) se han eliminado de la nueva interfaz de la API. - El mejor rendimiento se logra mediante la última Gemini Interactions API.
Cómo acceder a la API de Gemini 3.6 Flash
Paso 1: Obtener acceso a la API
Inicia sesión en cometAPI. Si aún no eres usuario, regístrate primero. Inicia sesión en tu consola de CometAPI. Obtén la clave de credenciales de acceso a la API. Haz clic en “Add Token” en el token de la API en el centro personal, obtén la clave del token: sk-xxxxx y envíala.

Paso 2: Enviar solicitudes a la API de Gemini 3.6 Flash
Selecciona el endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” para enviar la solicitud a la API y configura el cuerpo de la solicitud. El método de solicitud y el cuerpo de la solicitud se obtienen en la documentación de la API de nuestro sitio web. Nuestro sitio web también ofrece prueba en Apifox para tu comodidad. Reemplaza <YOUR_API_KEY> con tu clave real de CometAPI de tu cuenta. la URL base es Generación de contenido de Gemini
Inserta tu pregunta o solicitud en el campo content; esto es a lo que responderá el modelo. Procesa la respuesta de la API para obtener la respuesta generada.
Paso 3: Procesar respuestas
La API devuelve respuestas de candidatos estructuradas que incluyen texto generado, citas, metadatos de seguridad y salidas opcionales de herramientas.