API Gemini 3.6 Flash предоставляет разработчикам программный доступ к общедоступной модели Flash от Google для программных агентов, мультимодального анализа, работы со знаниями в длинном контексте и автоматизации с использованием инструментов. Google выпустила стабильную модель gemini-3.6-flash 21 июля 2026 года. В отличие от более ранней gemini-3-flash-preview, это стабильный идентификатор модели, предназначенный для постоянного использования в приложениях.
Gemini 3.6 Flash принимает текст, изображения, видео, аудио и PDF-файлы, но возвращает только текст. Окно ввода на 1 048 576 токенов позволяет обрабатывать большие репозитории, обширные наборы документов или продолжительные медиаданные, а ограничение вывода в 65 536 токенов поддерживает создание подробных отчетов, кода и структурированных ответов. Google указывает кэширование, структурированный вывод, вызов функций, выполнение кода, поиск по файлам, контекст URL, заземление Search, заземление Maps и настраиваемый уровень рассуждений среди возможностей базовой модели.
Важно учитывать ограничения возможностей. Gemini 3.6 Flash не создает изображения или аудио и не поддерживает Live API. Использование компьютера доступно как функция предварительного просмотра, а не как полностью стабильная возможность. Если интеграция зависит от инструмента, разработанного Google, перед миграцией убедитесь, что слой совместимости GPTProto предоставляет к нему доступ. Если вашему продукту требуется взаимодействие «речь-речь», встроенная генерация изображений или строгая стабильность для автоматизации на компьютерах, направьте эту часть рабочей нагрузки на другую модель.
| Спецификация | Gemini 3.6 Flash |
|---|---|
| Провайдер | |
| Статус | Общедоступная |
| Стабильный идентификатор модели | gemini-3.6-flash |
| Типы входных данных | Текст, изображения, видео, аудио, PDF |
| Тип выходных данных | Текст |
| Лимит входных токенов | 1 048 576 |
| Лимит выходных токенов | 65 536 |
| Уровни рассуждений | minimal, low, medium, high |
| Уровень рассуждений по умолчанию | medium |
| Инструменты, указанные Google | Вызов функций, выполнение кода, поиск по файлам, Search, Maps, контекст URL |
| Использование компьютера | Поддерживается в предварительной версии |
| Не поддерживается | Генерация изображений, генерация аудио, Live API |
Для каких задач лучше всего подходит Gemini 3.6 Flash
Gemini 3.6 Flash особенно полезна, когда задача требует одновременно большого рабочего контекста и многократных вызовов инструментов. Это не всегда самый дешевый выбор для каждого короткого запроса, а установленный по умолчанию средний уровень рассуждений может расходовать больше токенов, чем модель без рассуждений, даже при простой классификации. Подбирайте уровень рассуждений и маршрут модели в соответствии с конкретной задачей.
| Рабочая нагрузка | Почему подходит | Примечание по реализации |
|---|---|---|
| Программные агенты для работы с репозиториями | Меньше нежелательных изменений и циклов выполнения по сравнению с Gemini 3.5 Flash в тестировании Google | Используйте рассуждения уровня medium или high и проверяйте изменения с помощью тестов |
| Мультимодальный анализ документов | Читает PDF-файлы, изображения, диаграммы, аудио и видео в рамках одного запроса | Запрашивайте структурированный вывод, если последующим системам нужны стабильные поля |
| Исследования в длинном контексте | 1 млн входных токенов и поддержка кэширования контекста | Кэшируйте повторно используемые наборы данных вместо повторной отправки неизмененных файлов |
| Автоматизация в браузере или на компьютере | Нативные инструменты для использования компьютера и результат 83,0% в OSWorld-Verified в оценке Google | Считайте использование компьютера предварительной функцией и сохраняйте этапы подтверждения для значимых действий |
| Ассистенты с заземлением | Базовая модель поддерживает Search, Maps, поиск по файлам и контекст URL | Включайте только те инструменты, которые нужны для конкретного запроса, и отслеживайте итоговый расход токенов |
Gemini 3.6 Flash и Gemini 3.5 Flash
Gemini 3.6 Flash — это прямое повышение эффективности по сравнению с Gemini 3.5 Flash, а не замена модели с увеличенным контекстом. Обе модели сохраняют класс контекста в 1 млн токенов и средний уровень рассуждений по умолчанию. Разница заключается в эффективности выполнения задач: Google сообщает о снижении количества выходных токенов на 17% в рабочих нагрузках Artificial Analysis, меньшем числе шагов рассуждений и вызовов инструментов, а также более высоких результатах в программировании, инженерии машинного обучения, использовании компьютера и извлечении данных из длинного контекста.
Официальная стоимость входных данных остается равной $1.50 за 1 млн токенов, а стоимость выходных данных снижается с $9.00 до $7.50. В GPTProto Gemini 3.6 Flash стоит $0.90 за 1 млн входных токенов и $4.50 за 1 млн выходных токенов; Gemini 3.5 Flash в настоящее время стоит $0.90 и $5.40 соответственно. Для новых агентных или мультимодальных систем 3.6 Flash — лучший вариант по умолчанию. Сохраняйте 3.5 Flash только в том случае, если вы уже проверили ее поведение и вам нужно время для регрессионного тестирования миграции.
| Метрика | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| Контекстное окно | 1 048 576 | 1 048 576 |
| Максимальный вывод | 65 536 | 65 536 |
| Рассуждения по умолчанию | Средний | Средний |
| Стандартная стоимость Google: входные / выходные данные за 1 млн | $1.50 / $7.50 | $1.50 / $9.00 |
| Стоимость GPTProto: входные / выходные данные за 1 млн | $0.90 / $4.50 | $0.90 / $5.40 |
| DeepSWE v1.1 | 49.0% | 37.0% |
| MLE-Bench | 63.9% | 49.7% |
| OSWorld-Verified | 83.0% | 78.4% |
| GDM-MRCR v2 при 1 млн | 54.0% | 26.6% |
Приведенные выше показатели тестов предоставлены провайдером. Используйте их для выбора кандидатов, а затем протестируйте обе модели на собственных запросах, инструментах и критериях успеха, прежде чем переводить на них рабочий трафик.
Изменения API, которые нужно проверить перед миграцией
Не рассматривайте миграцию на 3.6 Flash только как замену имени модели, если ваше приложение использует нативный Interactions API Google. Google изменила несколько полей генерации и диалога для новейших моделей:
- Измените идентификатор модели на
gemini-3.6-flash. - Удалите
temperature,top_pиtop_kиз конфигурации генерации. - Замените
thinking_budgetнаthinking_level; поддерживаемые значения:minimal,low,mediumиhigh. - Удалите
candidate_count, который Gemini 3.x не поддерживает. - Не отправляйте предварительно заполненные сообщения модели. Для многошаговых сессий Interactions API используйте серверный параметр
previous_interaction_id. - Проведите регрессионное тестирование схем инструментов, структурированных выходных данных и обработки файлов перед переводом всего трафика.
Если вы используете формат запросов GPTProto, совместимый с OpenAI, руководствуйтесь разделами «Быстрый старт» и документацией GPTProto на этой странице, а не переносите поля Google-native напрямую. Практическое преимущество заключается в том, что один API-ключ и баланс GPTProto позволяют также вызывать Gemini 3.5 Flash, GPT-5.6 Luna, Claude Opus 4.8, Kimi K3 и еще более 200 моделей, поэтому вы можете запускать один и тот же набор тестов, не создавая отдельные учетные записи у провайдеров.







