A API Gemini 3.7 Flash oferece aos desenvolvedores acesso programático ao mais recente modelo Flash geralmente disponível do Google. Lançado em 13 de agosto de 2026, ele foi desenvolvido para engenharia de software, desenvolvimento web, trabalho multimodal com documentos e agentes de várias etapas que precisam de melhor seguimento de instruções e uso de ferramentas mais confiável do que a versão Flash anterior.
O Gemini 3.7 Flash aceita entradas de texto, imagens, vídeo, áudio e PDF, mas retorna apenas texto. Portanto, é adequado para entender uma captura de tela de um produto, revisar um fluxo de trabalho gravado, extrair evidências de relatórios ou raciocinar sobre um repositório. Ele não é um modelo nativo de geração de imagens, vídeos ou áudio.
No GPTProto, os desenvolvedores podem acessar o modelo sem manter um saldo separado para cada provedor. A mesma chave pode encaminhar solicitações para mais de 200 modelos compatíveis, facilitando a comparação do Gemini com alternativas ou a adição de um fallback sem abrir outra conta de provedor. O painel de preços ao vivo é a fonte de referência para os preços atuais da API Gemini 3.7 Flash e para o desconto exibido de 40%.
| Especificação |
Gemini 3.7 Flash |
| Provedor |
Google |
| Status de lançamento |
Geralmente disponível (GA) |
| Data de lançamento |
13 de agosto de 2026 |
| ID oficial do modelo |
gemini-3.7-flash |
| Modalidades de entrada |
Texto, imagem, vídeo, áudio e PDF |
| Modalidade de saída |
Texto |
| Limite de tokens de entrada |
1,048,576 tokens |
| Saída máxima |
65,536 tokens |
| Níveis de raciocínio |
low, medium (padrão), high |
| Recursos compatíveis no upstream |
Cache, chamadas de função, saídas estruturadas, execução de código, pesquisa de arquivos, contexto de URL, grounding com pesquisa e Maps, Computer Use (versão prévia) |
| Não compatível no upstream |
minimal thinking, geração nativa de imagens, geração de áudio e Live API |
| Opções de consumo no upstream |
Standard, Batch, Flex e Priority |
Aplicações da API Gemini 3.7 Flash
A API Gemini 3.7 Flash é mais adequada para cargas de trabalho que combinam várias etapas, em vez de solicitar uma única resposta curta. Para programação, ela pode inspecionar o contexto do repositório, rastrear um problema em vários arquivos, propor um patch mínimo e explicar a alteração. Para trabalhos de frontend, uma captura de tela ou referência de design pode ser incluída na solicitação para que o modelo compare o layout pretendido com a implementação.
Em fluxos de trabalho de agentes, o modelo pode decidir quando chamar uma função, interpretar resultados de ferramentas e retornar uma resposta que siga um esquema JSON. Os usos práticos incluem triagem de tickets de suporte, extração de documentos para bancos de dados, revisão de conformidade, pesquisa interna e automação de fluxos de trabalho. Os desenvolvedores podem reduzir o raciocínio para classificações sensíveis ao tempo ou aumentá-lo para tarefas difíceis de depuração e planejamento.
Sua entrada multimodal também é útil para trabalhos de conhecimento. Um único fluxo de trabalho pode combinar PDFs, gráficos, capturas de tela, reuniões gravadas e instruções escritas. Como a saída permanece em texto, use um modelo de geração dedicado quando o resultado final precisar ser um arquivo de imagem, vídeo ou áudio.
Gemini 3.7 Flash vs Gemini 3.6 Flash
O Gemini 3.7 Flash mantém o mesmo limite de entrada de 1,048,576 tokens, o limite de saída de 65,536 tokens e as amplas modalidades de entrada do Gemini 3.6 Flash. O motivo para fazer a atualização não é uma janela de contexto maior. É a melhoria em programação, desenvolvimento web, compreensão de documentos, seguimento de instruções e execução de agentes.
As avaliações de lançamento do Google relatam as seguintes mudanças. Estes são resultados de benchmarks informados pelo provedor, não testes independentes do GPTProto.
| Avaliação |
Gemini 3.7 Flash |
Gemini 3.6 Flash |
Mudança informada |
| FrontierCode 1.1 Main |
43.6% |
34.4% |
+9.2 pontos |
| DeepSWE v1.1 |
65.3% |
49.0% |
+16.3 pontos |
| WebDev Arena |
1588 Elo |
1538 Elo |
+50 Elo |
| GDP.pdf |
34.0% |
22.0% |
+12.0 pontos |
| AutomationBench |
30.4% |
17.0% |
+13.4 pontos |
Há uma desvantagem de compatibilidade: o Gemini 3.6 Flash aceita os níveis de raciocínio minimal, low, medium e high, enquanto o 3.7 é compatível apenas com low, medium e high. Se um fluxo de trabalho existente depende de raciocínio quase nulo para solicitações simples e de alto volume, mantenha o 3.6 em um teste A/B ou compare-o com um modelo Flash-Lite antes de migrar todo o tráfego.
Detalhes da migração a verificar antes da mudança
Alterar o nome do modelo é apenas o primeiro passo. Use a lista de verificação a seguir antes de substituir o Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3 Flash Preview ou Gemini 3.1 Pro em uma aplicação existente:
Use a string exata do modelo exibida na documentação do GPTProto. O ID estável oficial do Google é gemini-3.7-flash; confirme que a rota do GPTProto usa a mesma string antes de publicar ou fazer o deploy.
Não envie thinking_level: "minimal". O Google documenta medium como padrão e retorna um erro de validação quando minimal é selecionado.
Para migrações nativas da Interactions API do Gemini, remova as configurações obsoletas temperature, top_p, top_k e candidate_count, substitua thinking_budget por thinking_level e remova os turnos de modelo pré-preenchidos.
Mantenha precisas as expectativas multimodais: imagens, áudio, vídeo e PDFs são formatos de entrada, enquanto a resposta é texto.
Não presuma que todas as ferramentas do Google upstream estejam automaticamente disponíveis por meio de uma rota compatível com OpenAI. Consulte a documentação da API GPTProto ao vivo para verificar parâmetros, ferramentas, tratamento de arquivos e campos de resposta compatíveis.
Execute um teste canário com suas próprias tarefas de programação, esquemas, chamadas de ferramentas, metas de latência e orçamentos de tokens antes de transferir todas as solicitações.
Esta orientação de migração é uma diferença importante entre uma listagem básica de modelos e uma página útil de acesso à API Gemini 3.7 Flash: ela informa aos desenvolvedores quais solicitações existentes podem falhar mesmo quando o novo ID do modelo está correto.
Quando escolher o Gemini 3.7 Flash?
Escolha o Gemini 3.7 Flash quando uma carga de trabalho precisar de uma janela de contexto longa, vários formatos de entrada, melhor programação na primeira tentativa ou orquestração de ferramentas em várias etapas a um preço por token menor do que o de modelos flagship maiores. Mantenha o Gemini 3.6 Flash quando o raciocínio minimal for importante ou quando uma aplicação existente ainda não tiver passado pelos testes de regressão.
Para Grok 4.6 vs Gemini 3.7 Flash, a decisão é mais específica. O Gemini aceita entradas de áudio, vídeo e PDF e oferece uma janela de contexto mais de duas vezes maior que a do Grok. O Grok 4.6 adiciona uma opção de raciocínio xhigh e a SpaceXAI não documenta nenhum limite fixo de saída de texto. Nenhum dos modelos é universalmente melhor, portanto encaminhe tarefas representativas para ambos antes de selecionar um padrão.
| Fator de decisão |
Gemini 3.7 Flash |
Gemini 3.6 Flash |
Grok 4.6 |
| Melhor adequação |
Programação, fidelidade ao design, documentos multimodais, agentes de várias etapas |
Fluxos de trabalho Flash existentes e tráfego com raciocínio mínimo |
Programação e agentes que precisam de raciocínio xhigh ou de uma saída de texto muito longa |
| Janela de contexto |
1,048,576 tokens |
1,048,576 tokens |
500,000 tokens |
| Entradas nativas |
Texto, imagem, vídeo, áudio, PDF |
Texto, imagem, vídeo, áudio, PDF |
Texto, imagem |
| Limite de saída de texto |
65,536 tokens |
65,536 tokens |
Nenhum limite fixo documentado pela SpaceXAI |
| Controle de raciocínio |
Baixo, médio, alto |
Mínimo, baixo, médio, alto |
Baixo, médio, alto, xhigh |
| Preço oficial por token em contexto curto* |
$0.75 entrada / $3.75 saída até 31 de dezembro de 2026 |
$0.75 entrada / $3.75 saída até 31 de dezembro de 2026 |
$2 entrada / $6 saída abaixo de 200 mil tokens de entrada |
*Os preços oficiais do provedor são exibidos apenas para contextualizar a seleção do modelo. Use o painel de preços ao vivo do GPTProto para consultar a tarifa cobrada pelo GPTProto.