FLUX 3 and Gemini 3.7 Flash are now live on CometAPI →
ai-model/Investigación de CometAPI

¿Qué es Gemini 3.7 Flash? Pruebas comparativas, precio y guía de la API

gemini 3.7 Flash explicado con las mejoras en las pruebas de rendimiento de 3.6, precios de lanzamiento, acceso a la API, especificaciones, casos de uso

CometAPI
AnnaEquipo de investigación de modelos de IA y API
Actualizado Aug 14, 2026 16 min de lectura
¿Qué es Gemini 3.7 Flash? Pruebas comparativas, precio y guía de la API
Usa este patrón

Haz la primera llamada a la API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR Google lanzó Gemini 3.7 Flash el 13 de agosto de 2026, apenas tres semanas después de Gemini 3.6 Flash. Posicionado como el modelo “caballo de batalla” más inteligente de la compañía hasta la fecha para programación, flujos de trabajo agentivos, desarrollo web y trabajo con conocimiento, ofrece mejoras sustanciales frente a su predecesor, con un precio introductorio de $0.75 por millón de tokens de entrada y $3.75 por millón de tokens de salida hasta el 31 de diciembre de 2026 (la mitad de la tarifa original de 3.6 Flash). Admite una ventana de contexto de 1M de tokens, entradas multimodales (texto, imagen, video, audio, PDF), niveles de pensamiento ajustables y sólido uso de herramientas. Disponible mediante la Gemini API, Google AI Studio, Antigravity, Android Studio, Gemini Enterprise y agregadores como CometAPI.

Puntos clave

  • Gemini 3.7 Flash es una actualización iterativa importante enfocada en ingeniería de software del mundo real, agentes multi‑paso y desarrollo web adherente al diseño.
  • Aumentos en benchmarks clave frente a 3.6 Flash incluyen FrontierCode 1.1 Main (43.6% vs 34.4%), DeepSWE v1.1 (65.3% vs ~49%), WebDev Arena Elo (1588 vs 1538), GDP.pdf (34% vs 22%) y AutomationBench (30.4% vs 17%).
  • Precio introductorio de $0.75 / $3.75 por 1M de tokens de entrada/salida hasta finales de 2026; tarifas estándar de $1.50 / $7.50 a partir del 1 de enero de 2027.
  • Contexto de 1M, salida máxima de 64K–65K, niveles de pensamiento (bajo/medio/alto), llamadas a funciones, ejecución de código, uso de computadora (vista previa), grounding en búsqueda y salidas estructuradas.
  • Ideal para producción en agentes de programación, tareas de ingeniería de largo horizonte, generación de UI a partir de maquetas de diseño y flujos de documentos/conocimiento complejos con un costo atractivo.
  • CometAPI ofrece acceso sencillo y compatible con OpenAI a Gemini 3.7 Flash junto con más de 500 modelos, con facturación unificada y tarifas competitivas.

¿Qué es Gemini 3.7 Flash?

Gemini 3.7 Flash es el modelo estable más reciente de la línea Gemini 3 Flash de Google. Los modelos Flash están diseñados para equilibrar inteligencia, velocidad y costo en aplicaciones que realizan llamadas frecuentes al modelo. Son especialmente relevantes para agentes, ya que un agente puede necesitar razonar, llamar herramientas, inspeccionar resultados, corregir errores y continuar durante varias iteraciones antes de completar una solicitud del usuario.

Google describe 3.7 Flash como su modelo “caballo de batalla” más inteligente hasta la fecha para programación y agentes. Ese posicionamiento es importante. Gemini 3.7 Flash no se presenta como un reemplazo de todos los modelos de razonamiento de frontera, sino que busca ofrecer suficiente inteligencia para flujos de trabajo de producción exigentes manteniendo la latencia y la economía propias de Flash.

La ficha del modelo proporciona la explicación técnica más clara: Gemini 3.7 Flash se basa en Gemini 3.6 Flash e introduce mejoras algorítmicas en su base de razonamiento. Esto ayuda a explicar por qué Google lo lanzó solo tres semanas después de 3.6. Es una publicación de optimización y capacidades construida sobre la misma base, no una generación completamente nueva de preentrenamiento.

Especificaciones de Gemini 3.7 Flash

EspecificaciónGemini 3.7 Flash
ID de modelo establegemini-3.7-flash
Fecha de lanzamientoAugust 13, 2026
EstadoDisponibilidad general / estable
Tipos de entradaText, image, video, audio, PDF
Tipo de salidaText
Límite de tokens de entrada1,048,576
Límite de tokens de salida65,536
Niveles de pensamientoLow, medium, high
Llamadas a funcionesCompatible
Salida estructuradaCompatible
Ejecución de códigoCompatible
Grounding en búsquedaCompatible
Grounding en Google MapsCompatible
Contexto por URLCompatible
Búsqueda de archivosCompatible
Uso de computadoraCompatible en vista previa
Caché de contextoCompatible
Lote, Flex, inferencia prioritariaCompatible
Generación de imagen o audioNo compatible
Live APINo compatible
Fecha de corte de conocimientosMarch 2026, with some domains potentially limited to January 2025

¿Qué hay de nuevo en Gemini 3.7 Flash?

Programación agentiva más sólida

Las mayores mejoras se centran en la ingeniería de software. Google afirma que el modelo es mejor depurando, resolviendo incidencias, generando código listo para producción a la primera y manteniéndose eficaz en flujos de trabajo de programación más largos.

Esto importa porque el costo de un agente de programación no lo determina solo el número de tokens en una respuesta. Un modelo que produce un parche plausible pero defectuoso puede desencadenar más escaneos del repositorio, comandos de terminal, ejecuciones de pruebas, indicaciones de reparación y revisión humana. Una mayor precisión en el primer intento puede reducir el costo por resultado aceptado incluso cuando dos modelos tienen precios de token similares.

Según se informa, Gemini 3.7 Flash también se adapta mejor cuando encuentra obstáculos. Google describe una planificación y uso de herramientas más disciplinados, mejor clarificación de la intención y menos reintentos. Esas son mejoras operativas para asistentes en IDE, agentes de pull requests, sistemas de depuración y herramientas internas para desarrolladores.

Mejor desarrollo web y fidelidad de UI

Google afirma que 3.7 Flash puede crear diseños más funcionales y aplicaciones más completas en menos prompts. También está diseñado para seguir referencias visuales con mayor fidelidad, incluidas capturas de pantalla, imágenes y sistemas de diseño completos.

El resultado en Code Arena respalda este enfoque: 3.7 Flash alcanza 1588 Elo frente a 1538 de 3.6 Flash. Para equipos que construyen herramientas de screenshot‑to‑code, asistentes de diseño de sistemas, generadores de landing pages o prototipos full‑stack, la cuestión práctica es si el nuevo modelo reduce la corrección manual de CSS y la reparación de funciones faltantes. Eso debería medirse en tus propios componentes, puntos de quiebre y requisitos de accesibilidad.

Flujos empresariales más confiables

Gemini 3.7 Flash logra grandes avances en benchmarks con alta carga de conocimiento y automatización. Google destaca finanzas, derecho, biociencias, PDFs complejos y flujos de trabajo empresariales del mundo real.

Esto es distinto del simple QA. Los agentes empresariales a menudo necesitan leer varios documentos, extraer evidencia, comparar hechos, actualizar una hoja de cálculo o un documento de estado, redactar un correo y llamar a herramientas internas. AutomationBench sube de 17.0% a 30.4%, mientras que GDP.pdf sube de 22.0% a 34.0%. Estas puntuaciones están lejos de ser perfectas, pero las ganancias relativas son lo bastante grandes como para justificar volver a probar flujos que antes requerían un modelo más caro.

Contexto largo y uso de computadora mejorados

Gemini 3.7 Flash mantiene la capacidad de entrada de un millón de tokens y mejora la puntuación de contexto largo GDM‑MRCR v2 de Google del 91.8% al 97.0% en 128K. También mejora el desempeño en uso de computadora de OSWorld‑2.0 del 33.8% al 47.9%.

Una ventana de contexto grande no garantiza una recuperación fiable en cada token. La mejora en el benchmark sugiere un mejor uso de entradas largas, pero las pruebas de producción deben incluir el orden de los documentos, boilerplate repetido, estructura del código, tablas y el ruido de recuperación que tu aplicación realmente encuentra.

Salvaguardas de seguridad actualizadas

Google afirma que Gemini 3.7 Flash se entrega con protecciones actualizadas para usos indebidos químicos, biológicos, radiológicos y nucleares, y para ofensiva cibernética. La ficha del modelo reporta un desempeño de seguridad y tono en líneas generales similar a Gemini 3.6 Flash y señala que no se alcanzaron umbrales de capacidades de frontera rastreados.

La ficha también enumera limitaciones conocidas de los modelos fundacionales: alucinaciones, lentitud ocasional o timeouts, conocimiento incompleto y necesidad continua de mejorar la resistencia a jailbreaks. Las aplicaciones en entornos legales, financieros, médicos, de seguridad u otros entornos de alto impacto aún requieren verificación de fuentes y revisión humana.

Gemini 3.7 Flash vs Gemini 3.6 Flash: mejoras en benchmarks

La siguiente tabla utiliza la ficha del modelo de agosto de 2026 de Google. Los cambios en puntos porcentuales se calculan a partir de las puntuaciones publicadas. Las diferencias de Elo se muestran como puntos porque tratar Elo como un porcentaje sería engañoso.

Google y evaluadores independientes (incluido Artificial Analysis) reportan mejoras claras. Comparaciones seleccionadas:

BenchmarkGemini 3.7 FlashGemini 3.6 FlashCambio / Notas
Artificial Analysis Intelligence Index5652+4 puntos
FrontierCode 1.1 Main (código de producción)43.6%34.4%+9.2 puntos
DeepSWE v1.1 (SWE de largo horizonte)65.3%~48.6–49%+16+ puntos
Code Arena / WebDev Arena (Elo)15881538+50 Elo
Terminal-Bench 2.185.8%78.0%+7.8 puntos
Terminal-Bench 3.014.9%5.4%~2.8×
AutomationBench (flujos empresariales)30.4%17.0%+13.4 puntos
GDP.pdf (documentos complejos)34.0%22.0%+12 puntos
GDPval-AA v2 (Elo de trabajo con conocimiento)15251422+103 Elo
OSWorld-2.0 (uso de computadora)47.9%33.8%+14.1 puntos
GDM-MRCR (contexto largo, 128k)97.0%91.8%+5.2 puntos

Fuentes: ficha del modelo de Google DeepMind y blog oficial, evaluaciones independientes de Artificial Analysis (agosto de 2026). 3.7 Flash también compite de cerca o lidera frente a modelos de nivel medio‑frontera como Claude Sonnet 5 y GPT‑5.6 Terra en varias pruebas prácticas de programación y agentes, manteniéndose significativamente más barato.

Dónde es mayor la mejora

Las mayores ganancias prácticas están en DeepSWE, AutomationBench, GDP.pdf y OSWorld‑2.0. En relación con la puntuación de 3.6, esos incrementos son aproximadamente 34%, 79%, 55% y 42%, respectivamente. Los porcentajes relativos pueden exagerar los cambios cuando la base es baja, por lo que la mejora absoluta en puntos porcentuales debe seguir siendo la comparación primaria.

Terminal‑bench 3.0 es otro resultado llamativo: 14.9% frente a 5.4%. Es una ganancia absoluta de 9.5 puntos y una mejora relativa de ~176%, pero la puntuación final baja también muestra que las tareas de agentes autónomos generales siguen siendo difíciles.

Dónde Gemini 3.7 Flash no mejora

Gemini 3.7 Flash queda 0.7 puntos porcentuales por detrás de Gemini 3.6 Flash en ambas configuraciones de CharXiv. Es un recordatorio útil de que las actualizaciones del modelo no son uniformemente mejores. Si tu carga depende en gran medida de gráficos científicos complejos, diagramas o síntesis visual asistida por herramientas, mantén 3.6 disponible durante las pruebas y compara ambos modelos con entradas representativas.

Los benchmarks reportados por Google son evidencia valiosa de la versión, pero no sustituyen una evaluación específica de tu aplicación. Mide salidas aceptadas, latencia, errores de herramientas, reintentos, uso de tokens y tiempo de revisión humana en al menos 20 a 50 tareas reales antes de cambiar el tráfico de producción.

Precios de Gemini 3.7 Flash

Precios introductorios y estándar de Google

Google lista un precio introductorio hasta el 31 de diciembre de 2026:

PeriodoPrecio de entradaPrecio de salida
Through December 31, 2026$0.75 / 1M tokens$3.75 / 1M tokens
Starting January 1, 2027$1.50 / 1M tokens$7.50 / 1M tokens

Google describe la tarifa introductoria como la mitad del costo original de Gemini 3.6 Flash. La ficha detallada del modelo actualmente muestra la misma tarifa promocional tanto para 3.6 como para 3.7 Flash, seguida de la misma tarifa estándar a partir de enero de 2027. En otras palabras, 3.7 ofrece un rendimiento de benchmark superior al precio promocional actual, en lugar de cobrar una prima inmediata.

Los tokens de pensamiento normalmente se facturan como tokens de salida. El uso de herramientas también puede añadir tokens del modelo o cargos separados por la herramienta. El grounding en búsqueda, la recuperación de archivos, el contexto por URL, el uso de computadora y los pasos repetidos del agente pueden cambiar materialmente la factura final.

Precios en CometAPI

En la verificación realizada el 14 de agosto de 2026, CometAPI lista Gemini 3.7 Flash en:

RutaPrecio de entradaPrecio de salidaDiferencia frente al precio de lanzamiento de Google
Precio introductorio de Google$0.75 / 1M$3.75 / 1MReferencia
Precio listado en CometAPI$0.60 / 1M$3.00 / 1M20% inferior

Para una carga con un millón de tokens de entrada y 200,000 de salida, el costo de tokens con el precio introductorio de Google es $1.50: $0.75 por la entrada más $0.75 por la salida. Con las tarifas listadas de CometAPI, el mismo volumen de tokens es $1.20. Este cálculo excluye cargos por herramientas, caché, reintentos y cualquier diferencia en el comportamiento de las solicitudes.

No elijas una ruta solo por el precio de token. Compara el costo por resultado aceptado, porque una ruta más barata puede resultar más cara si produce más fallos, reintentos o escalados.

Cómo acceder a Gemini 3.7 Flash

1. Google AI Studio

Google AI Studio es el lugar más rápido para probar prompts y el comportamiento del modelo sin construir una aplicación completa. Abre el prompt de Gemini 3.7 Flash en AI Studio, obtén una clave de API y exporta código cuando el prompt esté listo.

2. Gemini API

Usa el código de modelo estable gemini-3.7-flash. La página del modelo de Google recomienda la Interactions API para acceder a las funciones actuales. El modelo admite niveles de pensamiento bajo, medio y alto, pero enviar minimal devuelve un error.

Los desarrolladores que migren desde generaciones anteriores de Gemini también deben revisar las reglas actuales de la API. Los parámetros de muestreo obsoletos y los turnos del modelo rellenados manualmente pueden no comportarse como lo hacían en integraciones anteriores.

3. Google Antigravity y Android Studio

Google lista Gemini 3.7 Flash para desarrollo “agent‑first” en Google Antigravity y para flujos de trabajo de programación en Android Studio. Estos entornos son apropiados cuando la tarea principal es la navegación por repositorios, el desarrollo de aplicaciones, las pruebas o la reparación de código impulsada por herramientas.

4. Gemini Enterprise y Gemini Spark

Las empresas pueden acceder al modelo a través de la Gemini Enterprise Agent Platform y la app Gemini Enterprise. Los suscriptores de Google AI Pro y Ultra en más de 160 países pueden usarlo mediante Gemini Spark, el agente personal de Google en la app Gemini.

5. CometAPI

CometAPI expone Gemini 3.7 Flash tanto mediante un formato de solicitud nativo de Gemini como mediante un patrón de chat‑completions compatible con OpenAI. Esto puede ser útil cuando un equipo desea una sola clave y capa de facturación para Google y familias de modelos competidoras.

Solicitud nativa de Gemini en CometAPI

model="gemini-3.7-flash"

curl "https://api.cometapi.com/v1beta/models/${model}:generateContent" \
  -H "x-goog-api-key: $COMETAPI_KEY" \
  -H "Content-Type: application/json" \
  -X POST \
  -d '{
    "contents": [{
      "parts": [{
        "text": "Review this implementation plan and identify the three highest-risk assumptions."
      }]
    }],
    "generationConfig": {
      "maxOutputTokens": 4096
    }
  }'

Solicitud en Python compatible con OpenAI a través de CometAPI

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gemini-3.7-flash",
    messages=[
        {
            "role": "user",
            "content": "Design a migration test plan from Gemini 3.6 Flash to 3.7 Flash.",
        }
    ],
)

print(response.choices[0].message.content)

Usa la ruta nativa de Gemini cuando necesites controles específicos del proveedor que no estén representados en la capa de compatibilidad. Usa la ruta compatible con OpenAI cuando la portabilidad y la comparación rápida de modelos sean la prioridad. Confirma los parámetros admitidos en la documentación en vivo antes de usar en producción.

Mejores casos de uso para Gemini 3.7 Flash

Agentes de programación e ingeniería de software

Gemini 3.7 Flash es un candidato sólido para depuración, resolución de incidencias, análisis de repositorios, generación de pruebas, refactorización y revisión de código. Sus mejoras en DeepSWE, FrontierCode y benchmarks de terminal hacen de la programación el caso de mejora más claro.

Generación web y de UI

Úsalo para flujos de trabajo de screenshot‑to‑code, implementación de sistemas de diseño, prototipos interactivos y generación de aplicaciones web full‑stack. Evalúa la fidelidad visual, el comportamiento responsive, la accesibilidad y la completitud de funciones en lugar de juzgar solo la primera captura.

Agentes de documentos empresariales

La ventana de contexto de un millón de tokens, la entrada de PDFs, la mejora en GDP.pdf, las llamadas a funciones y la búsqueda de archivos hacen que el modelo sea relevante para informes financieros, documentos legales, literatura científica, bibliotecas de políticas y sistemas de conocimiento internos.

Automatización multimodal y uso de computadora

Gemini 3.7 Flash puede razonar sobre texto, imágenes, video, audio y PDFs, mientras que el uso de computadora en vista previa habilita flujos impulsados por UI. Mantén la aprobación humana en acciones irreversibles, permisos, transacciones y decisiones de alto impacto.

Flujos de trabajo multi‑paso y de alto volumen

El modelo está diseñado para ejecución agentiva con economía de Flash. Puede reducir la necesidad de enviar cada tarea compleja a un modelo más caro. Una estrategia práctica de ruteo es comenzar con 3.7 Flash, validar el resultado y escalar solo los casos ambiguos o de alto riesgo.

Preguntas frecuentes

¿Qué es Gemini 3.7 Flash?

Gemini 3.7 Flash es el modelo Flash estable de agosto de 2026 de Google para programación, agentes de IA, desarrollo web, comprensión multimodal y trabajo con conocimiento en entornos empresariales. Se basa en Gemini 3.6 Flash y añade mejoras algorítmicas al razonamiento central.

¿Cuál es la ventana de contexto de Gemini 3.7 Flash?

Gemini 3.7 Flash admite hasta 1,048,576 tokens de entrada y hasta 65,536 tokens de salida. Acepta entrada de texto, imagen, video, audio y PDF, y devuelve texto.

¿Cuánto cuesta Gemini 3.7 Flash?

El precio introductorio de Google hasta el 31 de diciembre de 2026 es de $0.75 por millón de tokens de entrada y $3.75 por millón de tokens de salida. Google lista $1.50/M de entrada y $7.50/M de salida a partir del 1 de enero de 2027. CometAPI lista $0.60/M de entrada y $3.00/M de salida en el momento de la publicación.

¿Es mejor Gemini 3.7 Flash que Gemini 3.6 Flash?

Es mejor en la mayoría de los benchmarks publicados por Google, especialmente en código de producción, ingeniería de software de largo horizonte, automatización de flujos, comprensión de PDFs, recuperación en contexto largo y uso de computadora. Es ligeramente peor en razonamiento sobre gráficos de CharXiv, por lo que la respuesta depende de la carga de trabajo.

¿Es bueno Gemini 3.7 Flash para agentes de programación?

Sí. La programación y los agentes son sus casos de uso principales. Google reporta 65.3% frente a 48.6% para 3.6 Flash en DeepSWE v1.1 y 43.6% frente a 34.4% en FrontierCode 1.1 Main.

¿Gemini 3.7 Flash admite generación de imágenes?

No. Puede entender entradas de imagen, pero produce salida de texto. Este modelo no admite generación de imágenes ni de audio.

¿Qué niveles de pensamiento admite Gemini 3.7 Flash?

Admite pensamiento bajo, medio y alto. La página para desarrolladores de Google indica que el nivel minimal no está admitido y devuelve un error.

¿Cómo uso Gemini 3.7 Flash a través de CometAPI?

Crea una clave de CometAPI, elige gemini-3.7-flash y llama al endpoint nativo de Gemini /v1beta/models/{model}:generateContent o al endpoint compatible con OpenAI /v1/chat/completions. Revisa la página del modelo en vivo para ver precios y parámetros admitidos.

Conclusión

Gemini 3.7 Flash representa una mejora rápida y enfocada en la línea “caballo de batalla” de Google: capacidades de programación y agentes más sólidas, mejor adherencia al diseño para trabajos web y de UI, mejor desempeño en documentos complejos y trabajo con conocimiento, y un precio introductorio atractivo que hace más económicos los agentes de producción de alto volumen. Con un contexto de 1M de tokens, un conjunto robusto de herramientas y razonamiento ajustable, está bien preparado para la ingeniería de software del mundo real y la automatización multi‑paso.

Ya sea que accedas directamente mediante las herramientas de desarrollador de Google o a través de una plataforma unificada como CometAPI, Gemini 3.7 Flash está listo para la evaluación en producción hoy. Explora el catálogo de modelos en vivo y las tarifas competitivas en cometapi.com, reclama créditos de prueba gratuitos y comienza a crear agentes más confiables y rentables con el último modelo Flash de Google.

Seguir aprendiendo

Conecta este artículo con la siguiente decisión.

Ver todos los temas
Publicado el Aug 14, 2026
Última actualización Aug 14, 2026
1 visitas
Revisado para mayor claridad, atribución de fuentes y terminología API actual.

¿Listo para reducir los costos de desarrollo de IA en un 20%?

Comienza gratis en minutos. Créditos de prueba gratuitos incluidos. No se requiere tarjeta de crédito.

Leer Más