La API de Gemini 3.7 Flash proporciona a los desarrolladores acceso programático al modelo Flash más reciente de Google, disponible de forma general. Lanzado el 13 de agosto de 2026, está diseñado para ingeniería de software, desarrollo web, trabajo multimodal con documentos y agentes de varios pasos que necesitan un seguimiento más sólido de las instrucciones y un uso más fiable de las herramientas que la versión Flash anterior.
Gemini 3.7 Flash acepta entradas de texto, imágenes, vídeo, audio y PDF, pero solo devuelve texto. Por tanto, es adecuado para comprender una captura de pantalla de un producto, revisar un flujo de trabajo grabado, extraer pruebas de informes o razonar sobre un repositorio. No es un modelo nativo de generación de imágenes, vídeo o audio.
En GPTProto, los desarrolladores pueden acceder al modelo sin mantener un saldo separado para cada proveedor. La misma clave puede dirigir solicitudes a más de 200 modelos compatibles, lo que facilita comparar Gemini con alternativas o añadir un respaldo sin abrir otra cuenta de proveedor. El panel de precios en tiempo real es la fuente de referencia para conocer los precios actuales de la API de Gemini 3.7 Flash y el descuento mostrado del 40 %.
| Especificaciones |
Gemini 3.7 Flash |
| Proveedor |
Google |
| Estado de lanzamiento |
Disponible de forma general (GA) |
| Fecha de lanzamiento |
13 de agosto de 2026 |
| ID oficial del modelo |
gemini-3.7-flash |
| Modalidades de entrada |
Texto, imagen, vídeo, audio y PDF |
| Modalidad de salida |
Texto |
| Límite de tokens de entrada |
1,048,576 tokens |
| Salida máxima |
65,536 tokens |
| Niveles de razonamiento |
low, medium (predeterminado), high |
| Capacidades compatibles del proveedor ascendente |
Almacenamiento en caché, llamadas a funciones, salidas estructuradas, ejecución de código, búsqueda de archivos, contexto de URL, fundamentación mediante búsqueda y Maps, uso del ordenador (versión preliminar) |
| No compatible en el proveedor ascendente |
minimal razonamiento, generación nativa de imágenes, generación de audio y Live API |
| Opciones de consumo del proveedor ascendente |
Estándar, Batch, Flex y Priority |
Aplicaciones de la API de Gemini 3.7 Flash
La API de Gemini 3.7 Flash es más adecuada para cargas de trabajo que combinan varios pasos, en lugar de solicitar una única respuesta breve. En programación, puede inspeccionar el contexto de un repositorio, rastrear un problema entre archivos, proponer un parche mínimo y explicar el cambio. Para trabajos de frontend, se puede incluir una captura de pantalla o una referencia de diseño en la solicitud para que el modelo compare el diseño previsto con la implementación.
En los flujos de trabajo de agentes, el modelo puede decidir cuándo llamar a una función, interpretar los resultados de las herramientas y devolver una respuesta que siga un esquema JSON. Entre los usos prácticos se incluyen la clasificación de tickets de soporte, la extracción de documentos a bases de datos, la revisión de cumplimiento, la investigación interna y la automatización de flujos de trabajo. Los desarrolladores pueden reducir el razonamiento para clasificaciones sensibles al tiempo o aumentarlo para tareas difíciles de depuración y planificación.
Su entrada multimodal también resulta útil para el trabajo de gestión del conocimiento. Un único flujo de trabajo puede combinar archivos PDF, gráficos, capturas de pantalla, reuniones grabadas e instrucciones escritas. Como la salida sigue siendo texto, utiliza un modelo de generación especializado cuando el resultado final deba ser un archivo de imagen, vídeo o audio.
Gemini 3.7 Flash frente a Gemini 3.6 Flash
Gemini 3.7 Flash mantiene el mismo límite de entrada de 1,048,576 tokens, el límite de salida de 65,536 tokens y las amplias modalidades de entrada de Gemini 3.6 Flash. El motivo para actualizar no es una ventana de contexto más grande. Es la mejora en programación, desarrollo web, comprensión de documentos, seguimiento de instrucciones y ejecución de agentes.
Las evaluaciones de lanzamiento de Google informan de los siguientes cambios. Se trata de resultados de benchmarks comunicados por el proveedor, no de pruebas independientes de GPTProto.
| Evaluación |
Gemini 3.7 Flash |
Gemini 3.6 Flash |
Cambio informado |
| FrontierCode 1.1 Main |
43.6% |
34.4% |
+9.2 puntos |
| DeepSWE v1.1 |
65.3% |
49.0% |
+16.3 puntos |
| WebDev Arena |
1588 Elo |
1538 Elo |
+50 Elo |
| GDP.pdf |
34.0% |
22.0% |
+12.0 puntos |
| AutomationBench |
30.4% |
17.0% |
+13.4 puntos |
Existe una contrapartida de compatibilidad: Gemini 3.6 Flash acepta niveles de razonamiento minimal, low, medium y high, mientras que 3.7 solo admite low, medium y high. Si un flujo de trabajo existente depende de un razonamiento casi nulo para solicitudes sencillas y de gran volumen, mantén 3.6 en una prueba A/B o compáralo con un modelo Flash-Lite antes de migrar todo el tráfico.
Detalles de migración que debes comprobar antes de cambiar
Cambiar el nombre del modelo es solo el primer paso. Utiliza la siguiente lista de comprobación antes de sustituir Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3 Flash Preview o Gemini 3.1 Pro en una aplicación existente:
Utiliza la cadena exacta del modelo que aparece en la documentación de GPTProto. El ID estable oficial de Google es gemini-3.7-flash; confirma que la ruta de GPTProto utiliza la misma cadena antes de publicar o implementar.
No envíes thinking_level: "minimal". Google documenta medium como valor predeterminado y devuelve un error de validación cuando se selecciona minimal.
En las migraciones nativas a la API de Interactions de Gemini, elimina los ajustes obsoletos temperature, top_p, top_k y candidate_count, sustituye thinking_budget por thinking_level y elimina los turnos del modelo rellenados previamente.
Mantén precisas las expectativas multimodales: las imágenes, el audio, el vídeo y los archivos PDF son formatos de entrada, mientras que la respuesta es texto.
No des por hecho que todas las herramientas ascendentes de Google están disponibles automáticamente a través de una ruta compatible con OpenAI. Consulta la documentación actual de la API de GPTProto para comprobar los parámetros, las herramientas, la gestión de archivos y los campos de respuesta compatibles.
Ejecuta una prueba canaria con tus propias tareas de programación, esquemas, llamadas a herramientas, objetivos de latencia y presupuestos de tokens antes de trasladar todas las solicitudes.
Esta orientación de migración es una diferencia importante entre una lista básica de modelos y una página útil de acceso a la API de Gemini 3.7 Flash: indica a los desarrolladores qué solicitudes existentes pueden fallar incluso cuando el nuevo ID del modelo es correcto.
¿Cuándo deberías elegir Gemini 3.7 Flash?
Elige Gemini 3.7 Flash cuando una carga de trabajo necesite una ventana de contexto extensa, varios formatos de entrada, una programación inicial más sólida o una orquestación de herramientas de varios pasos a un precio por token inferior al de los modelos insignia más grandes. Mantén Gemini 3.6 Flash cuando el razonamiento minimal sea importante o cuando una aplicación existente aún no haya superado sus pruebas de regresión.
Para Grok 4.6 frente a Gemini 3.7 Flash, la decisión es más específica. Gemini acepta entradas de audio, vídeo y PDF, y ofrece una ventana de contexto más del doble de grande que la de Grok. Grok 4.6 añade una opción de razonamiento xhigh y SpaceXAI no documenta ningún límite fijo de salida de texto. Ningún modelo es universalmente mejor, así que dirige tareas representativas a ambos antes de seleccionar uno como predeterminado.
| Factor de decisión |
Gemini 3.7 Flash |
Gemini 3.6 Flash |
Grok 4.6 |
| Mejor opción para |
Programación, fidelidad al diseño, documentos multimodales y agentes de varios pasos |
Flujos de trabajo Flash existentes y tráfico con razonamiento mínimo |
Programación y agentes que necesitan razonamiento xhigh o una salida de texto muy extensa |
| Ventana de contexto |
1,048,576 tokens |
1,048,576 tokens |
500,000 tokens |
| Entradas nativas |
Texto, imagen, vídeo, audio y PDF |
Texto, imagen, vídeo, audio y PDF |
Texto e imagen |
| Límite de salida de texto |
65,536 tokens |
65,536 tokens |
Sin límite fijo documentado por SpaceXAI |
| Control del razonamiento |
Bajo, medio y alto |
Mínimo, bajo, medio y alto |
Bajo, medio, alto y xhigh |
| Precio oficial por token para contextos cortos* |
$0.75 de entrada / $3.75 de salida hasta el 31 de diciembre de 2026 |
$0.75 de entrada / $3.75 de salida hasta el 31 de diciembre de 2026 |
$2 de entrada / $6 de salida por debajo de 200K tokens de entrada |
*Los precios oficiales del proveedor se muestran únicamente como contexto para la selección del modelo. Utiliza el panel de precios en tiempo real de GPTProto para consultar la tarifa facturada a través de GPTProto.