API Gemini 3.7 Flash предоставляет разработчикам программный доступ к новейшей общедоступной Flash-модели Google. Выпущенная 13 августа 2026 года, она рассчитана на разработку ПО, веб-разработку, работу с мультимодальными документами и многошаговых агентов, которым нужно более точное следование инструкциям и более надежное использование инструментов, чем в предыдущем релизе Flash.
Gemini 3.7 Flash принимает на вход текст, изображения, видео, аудио и PDF, но возвращает только текст. Поэтому она подходит для анализа скриншота продукта, просмотра записанного рабочего процесса, извлечения доказательств из отчетов или рассуждений по репозиторию. Это не нативная модель генерации изображений, видео или аудио.
На GPTProto разработчики могут получить доступ к модели, не поддерживая отдельный баланс для каждого провайдера. Один и тот же ключ может направлять запросы к более чем 200 поддерживаемым моделям, что упрощает сравнение Gemini с альтернативами или добавление запасного варианта без открытия аккаунта у другого провайдера. Панель цен в реальном времени — основной источник актуальных цен на API Gemini 3.7 Flash и указанной скидки 40%.
| Спецификация |
Gemini 3.7 Flash |
| Провайдер |
Google |
| Статус релиза |
Общедоступная версия (GA) |
| Дата релиза |
13 августа 2026 года |
| Официальный идентификатор модели |
gemini-3.7-flash |
| Входные модальности |
Текст, изображения, видео, аудио и PDF |
| Выходная модальность |
Текст |
| Лимит входных токенов |
1,048,576 токенов |
| Максимальный выход |
65,536 токенов |
| Уровни мышления |
low, medium (по умолчанию), high |
| Поддерживаемые возможности провайдера |
Кэширование, вызов функций, структурированные выходные данные, выполнение кода, поиск по файлам, URL-контекст, поиск и привязка к картам, Computer Use (предварительная версия) |
| Что не поддерживается провайдером |
режим minimal мышления, нативная генерация изображений, генерация аудио и Live API |
| Варианты потребления у провайдера |
Standard, Batch, Flex и Priority |
Применение API Gemini 3.7 Flash
API Gemini 3.7 Flash лучше всего подходит для рабочих нагрузок, объединяющих несколько шагов, а не для короткого одиночного ответа. При написании кода она может изучить контекст репозитория, проследить проблему по файлам, предложить минимальный патч и объяснить изменение. Для фронтенд-задач в запрос можно включить скриншот или дизайн-референс, чтобы модель могла сравнить предполагаемый макет с реализацией.
Для агентных рабочих процессов модель может решать, когда вызывать функцию, интерпретировать результаты инструментов и возвращать ответ, соответствующий JSON-схеме. Практические примеры включают маршрутизацию тикетов поддержки, извлечение данных из документов в базу, комплаенс-проверки, внутренние исследования и автоматизацию процессов. Разработчики могут снижать уровень рассуждений для чувствительных ко времени задач классификации или повышать его для сложных задач отладки и планирования.
Мультимодальный вход также полезен для работы со знаниями. Один рабочий процесс может объединять PDF-файлы, диаграммы, скриншоты, записи встреч и письменные инструкции. Поскольку на выходе остаётся текст, используйте отдельную модель генерации, если итоговый результат должен быть файлом изображения, видео или аудио.
Gemini 3.7 Flash против Gemini 3.6 Flash
Gemini 3.7 Flash сохраняет тот же лимит входных токенов 1,048,576, лимит выходных токенов 65,536 и широкий набор входных модальностей, что и Gemini 3.6 Flash. Причина для перехода не в более широком контекстном окне, а в улучшении кодинга, веб-разработки, понимания документов, следования инструкциям и выполнения агентных задач.
В релизных оценках Google сообщается о следующих изменениях. Это результаты бенчмарков, предоставленные провайдером, а не независимые тесты GPTProto.
| Оценка |
Gemini 3.7 Flash |
Gemini 3.6 Flash |
Заявленное изменение |
| FrontierCode 1.1 Main |
43.6% |
34.4% |
+9.2 п.п. |
| DeepSWE v1.1 |
65.3% |
49.0% |
+16.3 п.п. |
| WebDev Arena |
1588 Elo |
1538 Elo |
+50 Elo |
| GDP.pdf |
34.0% |
22.0% |
+12.0 п.п. |
| AutomationBench |
30.4% |
17.0% |
+13.4 п.п. |
Есть один компромисс совместимости: Gemini 3.6 Flash принимает minimal, low, medium и high в качестве уровней мышления, тогда как 3.7 поддерживает только low, medium и high. Если существующий рабочий процесс зависит от почти нулевого мышления для простых высоконагруженных запросов, оставьте 3.6 в A/B-тесте или сравните её с моделью Flash-Lite, прежде чем переносить весь трафик.
Детали миграции, которые стоит проверить перед переходом
Смена названия модели — только первый шаг. Перед заменой Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3 Flash Preview или Gemini 3.1 Pro в существующем приложении используйте следующий чек-лист:
Используйте точную строку модели, указанную в документации GPTProto. Официальный стабильный идентификатор Google — gemini-3.7-flash; перед публикацией или развертыванием убедитесь, что маршрут GPTProto использует ту же строку.
Не отправляйте thinking_level: "minimal". Google документирует medium как значение по умолчанию и возвращает ошибку валидации при выборе minimal.
При миграции нативного Gemini Interactions API удалите устаревшие настройки temperature, top_p, top_k и candidate_count, замените thinking_budget на thinking_level и удалите предзаполненные ходы модели.
Точно формулируйте ожидания от мультимодальности: изображения, аудио, видео и PDF — это входные форматы, а ответ — текст.
Не предполагайте, что каждый инструмент Google у вышестоящего провайдера автоматически доступен через OpenAI-совместимый маршрут. Проверяйте актуальную документацию GPTProto API: поддерживаемые параметры, инструменты, обработку файлов и поля ответа.
Проведите канареечный тест на своих задачах кодинга, схемах, вызовах инструментов, целевых задержках и токен-бюджетах, прежде чем переносить все запросы.
Это руководство по миграции — главное отличие простого перечня моделей от полноценной страницы доступа к API Gemini 3.7 Flash: оно показывает разработчикам, какие существующие запросы могут завершиться ошибкой, даже если новый идентификатор модели указан верно.
Когда стоит выбрать Gemini 3.7 Flash?
Выбирайте Gemini 3.7 Flash, когда рабочей нагрузке нужны длинное контекстное окно, несколько входных форматов, более качественный код с первого раза или многошаговая оркестрация инструментов по более низкой цене за токен, чем у более крупных флагманских моделей. Оставьте Gemini 3.6 Flash, если важен режим minimal мышления или если существующее приложение ещё не прошло регрессионные тесты.
В сравнении Grok 4.6 и Gemini 3.7 Flash решение более конкретное. Gemini принимает аудио, видео и PDF на вход и предлагает более чем вдвое большее контекстное окно, чем у Grok. Grok 4.6 добавляет вариант рассуждений xhigh, а SpaceXAI не документирует фиксированный лимит текстового вывода. Ни одна модель не является универсально лучшей, поэтому прогоните репрезентативные задачи через обе, прежде чем выбирать модель по умолчанию.
| Критерий выбора |
Gemini 3.7 Flash |
Gemini 3.6 Flash |
Grok 4.6 |
| Наилучшее применение |
Кодинг, соблюдение дизайна, мультимодальные документы, многошаговые агенты |
Существующие Flash-процессы и трафик с minimal-мышлением |
Кодинг и агенты, которым нужно рассуждение xhigh или очень длинный текстовый вывод |
| Контекстное окно |
1,048,576 токенов |
1,048,576 токенов |
500,000 токенов |
| Входные форматы |
Текст, изображение, видео, аудио, PDF |
Текст, изображение, видео, аудио, PDF |
Текст, изображение |
| Лимит текстового вывода |
65,536 токенов |
65,536 токенов |
Фиксированный лимит не документирован SpaceXAI |
| Уровень рассуждений |
Low, medium, high |
Minimal, low, medium, high |
Low, medium, high, xhigh |
| Официальная цена за токен для короткого контекста* |
$0.75 за вход / $3.75 за выход до 31 декабря 2026 г. |
$0.75 за вход / $3.75 за выход до 31 декабря 2026 г. |
$2 за вход / $6 за выход при входном контексте менее 200K токенов |
*Официальные цены провайдера приведены только для контекста выбора модели. Для тарифа, выставляемого через GPTProto, используйте панель цен GPTProto в реальном времени.