GPT Proto

GPTProto

  • Panel
  • LLM

    • claude
      Claude Opus 5Nuevo
    • google
      Gemini 3.6 Flash
    • google
      Gemini 3.5 Flash Lite
    • moonshotai
      Kimi K3
    • openai
      GPT 5.6 Luna

    Imagen IA

    • bytedance
      Dola Seedream 5.0 Pro 260628Nuevo
    • google
      Gemini 3.1 Flash Lite Image
    • google
      Gemini 3.1 Flash Image
    • openai
      GPT Image 2
    • google
      Gemini 3.1 Flash Image Preview

    Vídeo IA

    • kling
      Kling v3.0 4kNuevo
    • bytedance
      Dreamina Seedance 2.0 Mini 260615
    • kling
      Kling v3 Omni 4k
    • bytedance
      Dreamina Seedance 2.0 Fast 260128
    • bytedance
      Dreamina Seedance 2.0 260128
    Explorar más de 214 modelos >
  • Generador

    • Generador de imágenes IA
    • Generador de vídeo IA
    • AI Canvas

    Funciones

    • IA de anime a la vida realNuevo
    • Generador de Arte Anime con IA
    • Eliminador de objetos con IA
    • Editor de imágenes con IA
    • Generador de imágenes con IA sin restricciones
    • Transferencia de movimiento con IA
    • Removedor de ropa con IA
    • Eliminador de marcas de agua con IA
    • Mejorador de imágenes con IA en línea
    • Herramienta online para eliminar fondos
    Explorar todo >

    Prompts

    • Prompts de Seedance 2.0Nuevo
    • Prompts de GPT Image 2
    • Prompts de Nano Banana Pro
    • Prompts de Seedream 5.0 Pro
  • Blog IA

    • GLM 5.2 frente a MiniMax M3: ¿Cuál es mejor para programación y trabajo frontend?
    • Cómo crear tu propio personaje de IA con una API: sin necesidad de programar
    • Kimi K3 frente a Claude Opus 5: ¿Cuál es mejor para programación y agentes de IA?
    • 20 prompts gratuitos de diseño de packaging con Seedream 5.0 Pro para productos y comercio electrónico
    • GLM-5.2 vs Kimi K3 para programar: ¿cuál es mejor para los desarrolladores en 2026?
    Explorar todo >

    Perspectivas IA

    • ¿Qué es Emochi AI y por qué está creciendo tan rápido? (2026)
    • ¿Qué es Kimi K3 y está realmente cerca de GPT-5.6 y Fable 5?
    • Las 12 mejores herramientas de generación de videos con IA en 2026 para YouTube, TikTok, texto e imágenes
    • ¿Qué es Qwen 3.8 Max? Fecha de lanzamiento, vista previa de 2,4T, precios y primeras pruebas de rendimiento
    • Gemini 3.6 Flash y Gemini 3.5 Flash-Lite explicados: ¿cuál deberías usar?
    Explorar todo >

    Documentación IA

    • gpt-image-2
    • gpt-5.4
    • kimi-k2.5
    • claude-opus-4-6
    • kling-v3.0-pro
    Explorar todo >

    Habilidades IA

    • browser-use
    • claude-to-im
    • competitive-ads-extractor
    • content-creator
    • data-storytelling
    Explorar todo >
Precios
English繁體中文한국어日本語EspañolРусский
Comience ahora
  1. Inicio
  2. /Modelo
  3. /Google
  4. /gemini-3.5-flash-lite
Google
gemini-3.5-flash-lite
CharlarDocumentación
Documentación
Gemini 3.5 Flash es un modelo de Google optimizado en costos y con una latencia ultrabaja. Cuenta con una ventana de contexto de 1 millón de tokens y compatibilidad multimodal nativa para tareas de texto, video y audio a escala.

$ 0.18
$ 0.3

$ 1.5
$ 2.5

text

text

$ 0.18
$ 0.3

text

$ 1.5
$ 2.5

text

Modelos relacionados
Todos los modelos
Claude
Claude
claude-opus-5
$ 20
$ 25
Google
Google
gemini-3.6-flash
$ 4.5
$ 7.5
MoonshotAI
MoonshotAI
kimi-k3
$ 13.5
$ 15
OpenAI
OpenAI
gpt-5.6-luna
$ 0.96
$ 1.2
Grok
Grok
grok-4.5
$ 3.6
$ 6
MiniMax
MiniMax
MiniMax-M3
$ 0.96
$ 1.2

API de Gemini 3.5 Flash-Lite

Accede al modelo Gemini 3.5 más rápido y rentable de Google en GPTProto por $0,18 por cada 1 M de tokens de entrada y $1,50 por cada 1 M de tokens de salida, un 40 % menos que las tarifas estándar de la API de Google. Usa una única clave de GPTProto y equilibra la carga entre más de 200 modelos de texto, imagen, vídeo y audio.

350 tokens de salida por segundo

Google informa de aproximadamente 350 tokens de salida por segundo según las pruebas de Artificial Analysis. Flash-Lite está diseñado para cargas de trabajo en las que el rendimiento y el tiempo de respuesta son más importantes que la máxima profundidad de razonamiento.

API rápida de Gemini

Entrada multimodal, salida de texto

Envía texto, imágenes, vídeo, audio y archivos PDF. El modelo devuelve texto, por lo que resulta adecuado para analizar documentos, comprender contenido multimedia, analizar transcripciones, generar resúmenes y extraer datos multimodales.

Gemini multimodal

Salidas estructuradas y uso de herramientas

Usa salidas restringidas por esquema y llamadas a funciones para la extracción, el enrutamiento y los agentes basados en herramientas. Confirma la disponibilidad específica de cada ruta para la ejecución de código, la búsqueda de archivos, el contexto de URL y la fundamentación mediante búsquedas antes de la implementación.

Modo JSON de Gemini

Ventana de contexto de 1 M de tokens

Procesa hasta 1.048.576 tokens de entrada y genera hasta 65.536 tokens de salida. Esta capacidad admite grandes conjuntos de documentos, transcripciones extensas, informes, repositorios y transferencias detalladas entre subagentes.

Contexto de Gemini

¿Qué es Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite es el modelo de eficiencia de disponibilidad general de Google para tareas agénticas de alto volumen, traducción, procesamiento de documentos, clasificación y extracción estructurada. Lanzado el 21 de julio de 2026, es el modelo más rápido de la serie Gemini 3.5 y está orientado a aplicaciones en las que la latencia, el rendimiento y el costo de la API son restricciones más estrictas que la máxima profundidad de razonamiento.

La API de Google Gemini 3.5 Flash-Lite acepta texto, imágenes, video, audio y archivos PDF dentro de una ventana de entrada de 1,048,576 tokens. Produce respuestas de texto de hasta 65,536 tokens y admite razonamiento, salidas estructuradas, llamadas a funciones, almacenamiento en caché, ejecución de código, búsqueda de archivos, contexto de URL y fundamentación mediante búsquedas en la API nativa de Google. No genera imágenes ni audio y no admite la Live API. La disponibilidad de las herramientas específicas del proveedor puede variar a través de una puerta de enlace compatible con OpenAI, así que consulta la documentación de GPTProto antes de depender de una extensión nativa de Google.

Especificación Gemini 3.5 Flash-Lite
Proveedor Google
ID de modelo estable gemini-3.5-flash-lite
Etapa de lanzamiento Disponibilidad general
Fecha de lanzamiento 21 de julio de 2026
Límite de entrada 1,048,576 tokens
Salida máxima 65,536 tokens
Entradas aceptadas Texto, imagen, video, audio, PDF
Salida Texto
Capacidades principales Razonamiento, salidas estructuradas, llamadas a funciones, almacenamiento en caché
No compatible Generación de imágenes, generación de audio, Live API, ajuste

Mejores usos de Gemini 3.5 Flash-Lite

Flash-Lite es más útil cuando una aplicación repite tareas específicas a gran escala. Puede funcionar como un modelo trabajador de menor costo bajo la coordinación de un orquestador más capaz, o encargarse de flujos de trabajo completos cuyas decisiones sean limitadas y fáciles de validar.

  • Clasificación y enrutamiento: Etiquetar tickets de soporte, detectar intenciones, asignar documentos o elegir la siguiente herramienta sin pagar por un modelo de vanguardia en cada solicitud.

  • Análisis de documentos y extracción a JSON: Leer PDF, facturas, recibos, informes y registros de productos, y devolver campos que coincidan con un esquema definido.

  • Traducción y resumen: Procesar grandes colas de texto multilingüe, transcripciones de reuniones, reseñas o contenido de catálogos cuando el costo unitario afecta el gasto operativo total.

  • Revisión multimodal: Extraer texto y datos de imágenes, audio grabado, video y PDF, manteniendo la salida en un flujo de trabajo posterior basado en texto.

  • Subagentes especializados: Delegar búsquedas, recuperación, ediciones de código, verificación y llamadas a herramientas a trabajadores especializados, reservando un modelo más potente para la planificación o la revisión final.

El modelo es menos adecuado cuando una solicitud difícil requiere la máxima precisión posible al programar, planificación a largo plazo o recuperación repetida ante errores de herramientas. Para esas cargas de trabajo, prueba Gemini 3.5 Flash o Gemini 3.6 Flash con el mismo conjunto de evaluación antes de elegir basándote únicamente en el precio por token.

Elige un nivel de razonamiento según la complejidad de la tarea

Gemini 3.5 Flash-Lite admite razonamiento configurable en la API nativa de Google. Google recomienda MINIMAL para clasificación, enrutamiento y extracción de JSON sensibles a la latencia. Esta configuración es la predeterminada y limita los tokens de razonamiento innecesarios en tareas predecibles.

Usa MEDIUM o HIGH para subagentes que escriban código, ejecuten comandos de terminal, llamen a varias API o deban recuperarse de errores intermedios. Un mayor razonamiento puede mejorar la ejecución en varios pasos, pero también aumenta el uso de tokens de salida y el tiempo de respuesta. Si llamas al modelo mediante el endpoint compatible con OpenAI de GPTProto, consulta la documentación actual para conocer el parámetro de razonamiento asignado antes de enviar campos específicos del proveedor.

Gemini 3.5 Flash-Lite frente a Gemini 3.5 Flash

Gemini 3.5 Flash-Lite y Gemini 3.5 Flash comparten una ventana de contexto de 1,048,576 tokens y una salida máxima de 65,536 tokens, pero están diseñados para economías de carga de trabajo diferentes. Flash-Lite prioriza el rendimiento y el bajo costo unitario; Flash está orientado a programación más compleja, planificación agéntica y trabajo de conocimiento.

Comparación Gemini 3.5 Flash-Lite Gemini 3.5 Flash
Más adecuado para Subagentes de alto volumen, extracción, traducción y análisis de documentos Programación compleja, planificación de agentes y trabajo de conocimiento más profundo
Posicionamiento del modelo El modelo más rápido y de menor costo de la serie 3.5 Modelo Flash más capaz
Contexto de entrada 1,048,576 tokens 1,048,576 tokens
Salida máxima 65,536 tokens 65,536 tokens
Precio estándar de entrada de Google $0.30 por 1M de tokens $1.50 por 1M de tokens
Precio estándar de salida de Google $2.50 por 1M de tokens $9.00 por 1M de tokens
Precio de GPTProto Flash-Lite $0.18 de entrada / $1.50 de salida por 1M de tokens Consulta la página del modelo Gemini 3.5 Flash

A las tarifas estándar de Google, Flash-Lite cuesta un 80 % menos en la entrada y aproximadamente un 72 % menos en la salida que Gemini 3.5 Flash. Elígelo cuando el volumen de solicitudes y el tiempo de respuesta dominen el costo de los reintentos ocasionales. Elige Flash cuando un número menor de tareas más difíciles haga que la calidad en el primer intento sea más importante que la tarifa de tokens más baja.

Uso de Gemini 3.5 Flash-Lite a través de GPTProto

GPTProto proporciona acceso a la API de Gemini 3.5 Flash-Lite mediante la misma cuenta, clave de API y saldo utilizados para más de 200 modelos. Esto reduce la fragmentación de cuentas y facturación cuando una aplicación dirige la extracción simple a Flash-Lite, el razonamiento complejo a Gemini 3.5 Flash o Gemini 3.6 Flash, y el trabajo multimedia a modelos independientes de imágenes, video o audio.

Para una aplicación existente compatible con OpenAI, conserva la estructura del cliente circundante y usa el endpoint, el método de autenticación y la cadena del modelo que se muestran en la documentación de GPTProto. No asumas que todos los campos nativos de Google se asignan uno a uno. Prueba los controles de razonamiento, el almacenamiento en caché, la fundamentación, la gestión de archivos, los esquemas de herramientas y el comportamiento de streaming antes de transferir tráfico de producción.

Notas de migración para cargas de trabajo existentes de Gemini

Google documenta varias diferencias de compatibilidad que pueden afectar las migraciones desde modelos Gemini anteriores. Los valores personalizados de temperature, top-K y top-P pueden ignorarse. Las penalizaciones personalizadas de frecuencia y presencia pueden devolver un error. Las solicitudes cuyo último turno de conversación tenga el rol model tampoco son compatibles.

Antes de cambiar un flujo de trabajo de alto volumen, vuelve a ejecutar un conjunto de pruebas representativo y comprueba el cumplimiento del esquema JSON, la finalización de las llamadas a herramientas, el uso de tokens, la latencia y la frecuencia de reintentos. Una implementación rentable de la API de Gemini 3.5 Flash-Lite debe evaluarse por el costo por tarea exitosa, no solo por el costo por token. Esto es especialmente importante para agentes de varios pasos, donde una configuración de razonamiento demasiado baja puede detener una secuencia de herramientas demasiado pronto.

Cómo obtener una clave API de gemini-3.5-flash-lite

Obtener una clave API de gemini-3.5-flash-lite lleva cuatro pasos y unos minutos. Crea una cuenta gratuita en GPTProto, añade créditos, genera tu clave y haz tu primera llamada — a $0.18 / $1.5 es una clave API de gemini-3.5-flash-lite más barata que ir directo, y una sola clave funciona con todos los modelos de la plataforma. La Documentación de gemini-3.5-flash-lite completa está en la documentación.

Inscribirse

Inscribirse

Cree su cuenta GPT Proto gratuita para comenzar. Puedes configurar una organización para tu equipo en cualquier momento.

Completar

Completar

Su balanza se puede utilizar en todos los modelos de la plataforma, incluido gemini-3.5-flash-lite, lo que le brinda la flexibilidad de experimentar y escalar según sea necesario.

Genera tu clave API

Genera tu clave API

En su panel de control, cree una clave API; la necesitará para autenticarse al realizar solicitudes a gemini-3.5-flash-lite.

Haz tu primera llamada API

Haz tu primera llamada API

Utilice su clave API con nuestro código de muestra para enviar una solicitud a gemini-3.5-flash-lite a través de GPT Proto y ver resultados instantáneos impulsados ​​por IA.

Obtener API Key

Preguntas frecuentes

¿Cuánto cuesta la API de Gemini 3.5 Flash-Lite en GPTProto?

GPTProto ofrece Gemini 3.5 Flash-Lite a $0.18 por cada 1 millón de tokens de entrada y $1.50 por cada 1 millón de tokens de salida. Las tarifas estándar de la API de Google son de $0.30 y $2.50, respectivamente, por lo que las tarifas de GPTProto son un 40% más bajas. Una solicitud con 10,000 tokens de entrada y 2,000 tokens de salida costaría aproximadamente $0.0048.

¿Necesito una clave de API de Google Gemini 3.5 Flash-Lite independiente?

No. El acceso a la API de Gemini 3.5 Flash-Lite en GPTProto utiliza tu clave de API de GPTProto y el saldo compartido de la cuenta. La misma clave puede llamar a más de 200 modelos compatibles, por lo que no necesitas una cuenta de proveedor ni un saldo de crédito separados para cada modelo.

¿Cuál es el límite de contexto de Gemini 3.5 Flash-Lite?

El modelo acepta hasta 1,048,576 tokens de entrada y puede devolver hasta 65,536 tokens de salida. El límite se aplica al prompt combinado y a las entradas multimodales después de la tokenización, por lo que los archivos PDF, el audio y el video grandes pueden consumir el contexto de forma diferente al texto plano.

¿Puede Gemini 3.5 Flash-Lite procesar imágenes, video, audio y PDF?

Sí. Acepta entradas de texto, imágenes, video, audio y PDF, y luego devuelve texto. Puede analizar o extraer información de esos tipos de medios, pero no es un modelo de generación de imágenes, generación de video, conversión de texto a voz ni voz en tiempo real.

¿Gemini 3.5 Flash-Lite admite el modo JSON y las llamadas a funciones?

Google indica que las salidas estructuradas y las llamadas a funciones son capacidades compatibles. Son útiles para la extracción basada en esquemas y los agentes controlados por herramientas. Como las asignaciones de parámetros de la pasarela pueden diferir, valida el esquema exacto de la solicitud y el comportamiento de las herramientas mediante GPTProto antes de implementar un flujo de trabajo crítico.

¿Debería usar Gemini 3.5 Flash-Lite o Gemini 3.5 Flash?

Usa Flash-Lite para clasificación de gran volumen, extracción, traducción, procesamiento de documentos y subagentes enfocados. Usa Gemini 3.5 Flash cuando la programación compleja, una planificación más profunda o un razonamiento inicial más sólido justifiquen un mayor costo de tokens. Prueba ambos en tareas representativas cuando el costo de un fallo o de un reintento sea significativo.

¿Gemini 3.5 Flash-Lite es un modelo estable?

Sí. Google indica que gemini-3.5-flash-lite es un modelo de disponibilidad general lanzado el 21 de julio de 2026. Esto lo distingue de los ID de modelos preliminares, que pueden cambiar con mayor frecuencia o tener límites de uso más estrictos.

Artículos relacionados

Más blogs
Los 7 mejores generadores de imágenes con IA sin restricciones en 2026 (comparativa)

Los 7 mejores generadores de imágenes con IA sin restricciones en 2026 (comparativa)

Deja de encontrarte con límites de seguridad. Descubre el mejor generador de imágenes con IA sin restricciones para recuperar tu libertad creativa. Compara las mejores herramientas y empieza a crear hoy mismo.

Gemini 3.6 Flash y Gemini 3.5 Flash-Lite: ¿cuál deberías usar?

Gemini 3.6 Flash y Gemini 3.5 Flash-Lite: ¿cuál deberías usar?

Compara los precios, la velocidad, las pruebas de referencia y los casos de uso de Gemini 3.6 Flash y Gemini 3.5 Flash-Lite. Descubre qué nuevo modelo de Google se adapta mejor a tu carga de trabajo de IA.

Qwen 3.8 Max frente a GLM 5.2: ¿cuál es mejor para programar en 2026?

Qwen 3.8 Max frente a GLM 5.2: ¿cuál es mejor para programar en 2026?

Compara Qwen 3.8 Max y GLM 5.2 en programación, acceso a la API, contexto, precios y pesos abiertos. Descubre qué modelo es más seguro para producción en 2026.

¿Qué es Kimi K3 y está realmente cerca de GPT-5.6 y Fable 5?

¿Qué es Kimi K3 y está realmente cerca de GPT-5.6 y Fable 5?

¿Kimi K3 es de código abierto y está realmente cerca de GPT-5.6 y Fable 5? Explora su contexto de 1 millón de tokens, los precios de la API, las pruebas de referencia independientes y las reacciones en Reddit.

GPT Proto

Potenciar la innovación en IA con escala y estabilidad globales:

Con nuestro producto estrella, GPT Proto, ofrecemos una interfaz unificada para acceder y combinar API de los principales proveedores de IA del mundo, que abarcan texto, visión, voz y más. Capacitamos a los desarrolladores y empresas para que simplifiquen la integración y aceleren la innovación sin límites.

Infraestructura global, cumplimiento local:

Para garantizar la confiabilidad y el cumplimiento de nivel empresarial, Talent Tech Global Limited opera específicamente como nuestra entidad global de facturación y contratación. Mientras tanto, nuestra infraestructura técnica central y nuestros equipos de I+D están distribuidos estratégicamente en centros de innovación globales, incluidos Silicon Valley, Singapur y Hong Kong.

Construido a escala:

Entendemos que la estabilidad es primordial. Nuestra plataforma se basa en una arquitectura robusta y descentralizada que admite el escalado automático dinámico. Ya sea que esté ejecutando una prueba piloto o manejando millones de solicitudes simultáneas, nuestro sistema se expande instantáneamente para satisfacer la demanda, garantizando que su negocio nunca supere nuestra infraestructura.

Navegación

  • Panel
  • Modelo
  • Generador de imágenes IA
  • Escalado de imagen IA
  • Eliminador de fondo IA
  • Generador de vídeo IA
  • AI Canvas
  • Funciones
  • Precios
  • Documentación IA
  • Blog IA
  • Perspectivas IA
  • Habilidades IA

Funciones

  • IA de anime a la vida real
  • Generador de Arte Anime con IA
  • Eliminador de objetos con IA
  • Editor de imágenes con IA
  • Generador de imágenes con IA sin restricciones
  • Transferencia de movimiento con IA
  • Removedor de ropa con IA
  • Eliminador de marcas de agua con IA
  • Mejorador de imágenes con IA en línea
  • Herramienta online para eliminar fondos
  • Imagen de intercambio de rostros con IA
  • Creador de fotos de pasaporte con IA
  • Generador de IA de MS Paint
Explore all features >

LLM

  • Claude Opus 5
  • Gemini 3.6 Flash
  • Gemini 3.5 Flash Lite
  • Kimi K3
  • GPT 5.6 Luna
  • GPT 5.6 Terra
  • GPT 5.6 Sol
  • Grok 4.5
  • Claude Sonnet 5
  • Minimax M3
  • GLM 5.2
  • GPT 5.1 Chat Latest
  • Claude Fable 5
  • Qwen3.7 Max
  • Claude Opus 4.8 Thinking
  • Claude Opus 4.8
  • Gemini 3.5 Flash
  • DeepSeek v4 Flash
  • DeepSeek v4 Pro
  • Grok 4.3
Más modelo

Imagen IA

  • Dola Seedream 5.0 Pro 260628
  • Gemini 3.1 Flash Lite Image
  • Gemini 3.1 Flash Image
  • GPT Image 2
  • Gemini 3.1 Flash Image Preview
  • Seedream 5.0 260128
  • Doubao Seedream 5.0 260128
  • Vidu Q2
  • Grok Imagine Image
  • Kling Image O1
  • GPT Image 1.5
  • Seedream 4.5 251128
  • Doubao Seedream 4.5 251128
  • Grok Imagine 0.9
  • Gemini 3 Pro Image Preview
  • Qwen Image Lora
  • Qwen Image Plus Lora
  • Qwen Image Plus
  • Grok 4 Image
  • GPT Image 1 Mini
Más modelo

Vídeo IA

  • Kling v3.0 4k
  • Dreamina Seedance 2.0 Mini 260615
  • Kling v3 Omni 4k
  • Dreamina Seedance 2.0 Fast 260128
  • Dreamina Seedance 2.0 260128
  • Vidu 2.0
  • Doubao Seedance 2.0 260128
  • Doubao Seedance 2.0 Fast 260128
  • Kling v3 Omni Pro
  • Kling v3 Omni Std
  • Vidu Q3 Turbo
  • Kling v3.0 Pro
  • Kling v3.0 Std
  • Vidu Q3 Pro
  • Kling v2.6 Std
  • Vidu Q2 Pro
  • Vidu Q2 Turbo
  • Vidu Q2 Pro Fast
  • Vidu Q2
  • Kling Video O1 Pro
Más modelo

© 2026 Talent Tech Global Limited (Hong Kong) / Talent Tech Global LLC (US). Todos los derechos reservados.

  • Sobre nosotros
  • política de privacidad
  • Términos de servicio
  • Mapa del sitio