Gemini 3.7 Flash: бенчмарки, цены, доступность API и что изменилось
Google выпустила Gemini 3.7 Flash 13 августа 2026 года, всего через три недели после Gemini 3.6 Flash. Обновление нацелено в первую очередь на кодирование, агентские рабочие процессы, веб-разработку и работу с документами, требующую больших знаний. Google опубликовала существенные улучшения по сравнению с 3.6 Flash по нескольким показателям программной инженерии и автоматизации.
Необычная часть — цены: Gemini 3.7 Flash запускается по цене 0,75 доллара за миллион входных токенов и 3,75 доллара за миллион выходных токенов через стандартный платный API до 31 декабря 2026 года. Эти тарифы временные и удвоятся 1 января 2027 года. В этом руководстве объясняются результаты тестов, доступность API, лимиты модели, поддерживаемые инструменты, уровни цен и практические отличия от Gemini 3.6 Flash.
Ключевые выводы
- Выпуск: Gemini 3.7 Flash стал общедоступным 13 августа 2026 года.
- Идентификатор модели API: Стабильным идентификатором Gemini API является
gemini-3.7-flash. - Вступительные цены: Стандартное платное использование стоит 0,75 доллара за 1 миллион входных токенов и 3,75 доллара за 1 миллион выходных токенов до 31 декабря 2026 года. С 1 января 2027 года эти тарифы составят 1,50 и 7,50 доллара.
- Увеличение показателей бенчмарков: Google сообщает о 43,6% на FrontierCode 1.1 Main, 65,3% на DeepSWE v1.1, 1588 Elo на Code Arena и 30,4% на AutomationBench.
- Контекст: Модель принимает до 1 048 576 входных токенов и может возвращать до 65 536 выходных токенов.
- Доступность: Google распространяет его через Gemini API, Google AI Studio, Google Antigravity, продукты Gemini Enterprise и Gemini Spark для соответствующих подписчиков Google AI Pro и Ultra.
Gemini 3.7 Flash вкратце
| Спецификация | Gemini 3.7 Flash |
|---|---|
| Дата выпуска | 13 августа 2026 года |
| Стадия запуска | Общедоступен (GA) |
| Идентификатор стабильной модели API | gemini-3.7-flash |
| Входные модальности | Текст, изображение, видео, аудио и PDF |
| Выходная модальность | Текст |
| Лимит входных токенов | 1 048 576 токенов |
| Максимальный выход | 65 536 токенов |
| Уровни мышления | Низкий, средний и высокий; минимальный не поддерживается |
| Цена стандартного платного API до 31 декабря 2026 г. | 0,75 долл. США / 1 млн входных токенов; 3,75 долл. США / 1 млн выходных токенов |
Что такое Gemini 3.7 Flash?
Gemini 3.7 Flash — это следующая итерация семейства Gemini 3 Flash от Google. Google DeepMind заявляет, что он основан на Gemini 3.6 Flash и добавляет алгоритмические улучшения в основную основу рассуждений модели. Позиционирование также стало более явным: Google называет 3.7 Flash своим основным "рабочей лошадкой" для кодирования и агентов, а не моделью, предназначенной просто для максимизации пропускной способности.
Это различие имеет значение. Модели Flash традиционно выбирались потому, что они быстрее и дешевле, чем самые мощные модели рассуждений. С 3.7 Google пытается перенести больше многоэтапных задач на этот экономичный уровень: кодирование на уровне репозитория, взаимодействие с браузером или компьютером, вызов функций, сложная обработка документов и бизнес-процессы, требующие нескольких вызовов инструментов перед завершением ответа.
Если вы пришли от предшественника, обзор Gemini 3.6 Flash предоставляет контекст выпуска предыдущей модели. Важное обновление теперь заключается в том, что 3.7 Flash сохраняет то же окно контекста в миллион токенов и широкий набор инструментов, одновременно повышая производительность по многим опубликованным Google оценкам агентов и кодирования.
Что изменилось по сравнению с Gemini 3.6 Flash?
| Область | Изменение Gemini 3.7 Flash | Практический эффект |
|---|---|---|
| Кодирование | Более высокие результаты FrontierCode, DeepSWE и Terminal-bench | Более убедительный случай для работы с репозиториями, отладки и долгосрочных кодирующих агентов |
| Веб-разработка | Code Arena вырос с 1538 до 1588 Elo в карточке модели Google | Лучшая опубликованная производительность на функциональных макетах и полных веб-задачах |
| Корпоративная автоматизация | AutomationBench вырос с 17,0% до 30,4% | Более перспективно для рабочих процессов, сочетающих рассуждения, инструменты и бизнес-системы |
| Рассуждение по документам | GDP.pdf вырос с 22,0% до 34,0% | Улучшенный опубликованный результат для сложной работы со знаниями на основе PDF |
| Длинный контекст | GDM-MRCR v2 при 128 тыс. вырос с 91,8% до 97,0% | Лучшее извлечение и рассуждение по длинным входным данным в этой оценке |
| Поведение разработчика | Google утверждает, что модель лучше адаптируется к препятствиям, уточняет намерения и более добросовестно следует инструкциям | Потенциально меньше повторных попыток и меньше ручного надзора в многоэтапных рабочих процессах |
| Цены | 3.7 запускается по временной ставке 0,75 доллара за вход / 3,75 доллара за выход за 1 миллион токенов | Более низкая краткосрочная стоимость, чем первоначальная ставка запуска 3.6, хотя 3.6 теперь имеет ту же временную ставку |
Последнюю строку легко неверно истолковать. Google описывает Gemini 3.7 Flash как запущенный вдвое дешевле, чем первоначальная стоимость Gemini 3.6 Flash. Однако текущая карточка модели Google перечисляет как 3.6 Flash, так и 3.7 Flash по цене 0,75 доллара за вход и 3,75 доллара за выход за миллион токенов в рамках той же временной акции. Таким образом, 3.7 в настоящее время не дешевле за стандартный токен, чем 3.6; сравнение ведется с первоначальной ценой запуска 3.6.
Бенчмарки Gemini 3.7 Flash
Карточка модели Google от августа 2026 года публикует широкий набор тестов, охватывающих программную инженерию, агентское использование терминала, корпоративную автоматизацию, работу со знаниями, PDF, длинный контекст, использование компьютера и научные рассуждения. Цифры ниже сравнивают Gemini 3.7 Flash с Gemini 3.6 Flash, используя значения из этой карточки модели.
| Бенчмарк | Что он измеряет | Gemini 3.6 Flash | Gemini 3.7 Flash |
|---|---|---|---|
| Индекс искусственного анализа интеллекта | Интеллект составной модели | 52 | 56 |
| FrontierCode 1.1 Основная | Качество производственного кода | 34.4% | 43.6% |
| DeepSWE v1.1 | Инженерия программного обеспечения на большом горизонте | 48.6% | 65.3% |
| Code Arena | Веб-разработка | 1538 Elo | 1588 Elo |
| Terminal-bench 2.1 | Агентное кодирование в терминале | 78.0% | 85.8% |
| AutomationBench | Автоматизация корпоративных рабочих процессов | 17.0% | 30.4% |
| GDP.pdf | Экспертное понимание PDF | 22.0% | 34.0% |
| GDM-MRCR v2 при 128k | Извлечение информации и рассуждения в большом контексте | 91.8% | 97.0% |
| OSWorld-2.0 | Агентное использование компьютера | 33.8% | 47.9% |

Источник: blog.google
Где улучшения наиболее заметны
Наиболее явные изменения наблюдаются в рабочих нагрузках, которые требуют от модели постоянной работы, а не однократного ответа. DeepSWE поднимается с 48,6% до 65,3%, в то время как AutomationBench перемещается с 17,0% до 30,4%. Это подтверждает заявление Google о том, что модель более полезна для агентов, которым необходимо планировать, использовать инструменты, проверять результаты и преодолевать препятствия.
Работа с документами также значительно улучшается по опубликованным данным Google. GDP.pdf перемещается с 22,0% до 34,0%, и компания особо выделяет финансы, юриспруденцию и бионауки как области с высокой плотностью знаний, где ожидается лучшее рассуждение. Это не означает, что модель может заменить экспертную оценку в регулируемых или ответственных работах; это означает, что результат теста материально выше, чем у 3.6 Flash на протестированных задачах.
3.7 Flash не выигрывает во всех тестах
Выпуск не является полным триумфом. На CharXiv без инструментов Gemini 3.7 Flash набирает 84,5% по сравнению с 85,2% у 3.6 Flash; с инструментами он набирает 88,7% по сравнению с 89,4%. В таблице кросс-модельных сравнений Google GPT-5.6 Terra также остается впереди по некоторым оценкам кодирования и терминалов. Именно поэтому таблицу сравнения следует использовать для выявления перспективных рабочих нагрузок, а не для объявления универсального победителя.
Также стоит отметить небольшое расхождение в отчетности: в статье о запуске Google результат DeepSWE для Gemini 3.6 Flash округляется до 49,0%, в то время как в подробной карточке модели DeepMind указано 48,6%. В этой статье используется более точное значение карточки модели в сравнительной таблице.

Источник: blog.google
Цены Gemini 3.7 Flash
Gemini 3.7 Flash имеет ограниченный по времени график ценообразования. Текущие вводные тарифы действуют до 31 декабря 2026 года. Документация по ценам Google затем удваивает тарифы на токены 1 января 2027 года.
| Вариант потребления | Входные данные / 1 млн токенов до 31 декабря 2026 г. | Выходные данные / 1 млн токенов до 31 декабря 2026 г. | Входные/выходные данные с 1 января 2027 г. |
|---|---|---|---|
| Стандартная оплата | $0.75 | $3.75 | $1.50 / $7.50 |
| Пакетная | $0.375 | $1.875 | $0.75 / $3.75 |
| Flex | $0.375 | $1.875 | $0.75 / $3.75 |
| Приоритет | $1.35 | $6.75 | $2.70 / $13.50 |
Цены на выходные данные включают токены для размышлений. Стандартное кэширование контекста стоит 0,075 доллара за миллион кэшированных токенов в течение вводного периода, плюс 0,50 доллара за миллион токенов в час за хранение кэша; эти тарифы также удваиваются в 2027 году. Заземление Google Поиск и заземление Google Карты могут взиматься отдельно после общего ежемесячного лимита, описанного в документации по ценам Google.
Стандартный API также имеет бесплатный уровень, указанный как бесплатный. Его не следует рассматривать как гарантированную производственную мощность: ограничения скорости зависят от модели, проекта, уровня использования и статуса учетной записи, и Google явно заявляет, что опубликованные ограничения не гарантируются. Для платных производственных рабочих нагрузок стоимость модели — лишь часть бюджета; заземление, внешние API, хранение и неудачные или повторяющиеся шаги агента могут изменить общую сумму.
Примерные стандартные затраты на API
| Ежемесячное использование токенов | Оценочная стоимость до 31 декабря 2026 г. | Оценочная стоимость с 1 января 2027 г. |
|---|---|---|
| 10 млн входных + 2 млн выходных | $15.00 | $30.00 |
| 50 млн входных + 5 млн выходных | $56.25 | $112.50 |
| 100 млн входных + 20 млн выходных | $150.00 | $300.00 |
Эти примеры включают только входные и выходные токены модели. Они не включают заземление, хранение кэша, внешние службы или инфраструктуру приложения.
Доступность Gemini 3.7 Flash API
Gemini 3.7 Flash — это не анонс только для предварительного просмотра. Google Cloud перечисляет gemini-3.7-flash как GA с датой выпуска 13 августа 2026 года, а документация Gemini API определяет ту же строку как стабильную версию модели.
| Группа пользователей | Где доступен Gemini 3.7 Flash | Важная деталь |
|---|---|---|
| Разработчики API | Gemini API и Google AI Studio | Используйте стабильный идентификатор модели gemini-3.7-flash |
| Разработчики Android | Android Studio | Google перечисляет Android Studio как поверхность запуска для разработчиков |
| Разработчики агентов | Google Antigravity | Разработан для кодирования, ориентированного на агентов, и многошаговых рабочих процессов |
| Предприятия | Gemini Enterprise Agent Platform и приложение Gemini Enterprise | Применяется корпоративное управление, биллинг и региональные контроли |
| Частные лица | Gemini Spark в приложении Gemini | Google утверждает, что Spark использует 3.7 Flash для подписчиков Google AI Pro и Ultra в более чем 160 поддерживаемых странах |
Для разработчиков, которые еще не настроили доступ, руководство по ключам API Gemini охватывает настройку Google AI Studio. После готовности доступа критическим изменением для развертывания является идентификатор модели; миграция в производственную среду по-прежнему должна включать регрессионные тесты для инструментов, схем, задержек и общего использования токенов.

Источник: pexels.com
Ограничения скорости специфичны для проекта
Не существует единого числа RPM или TPM для Gemini 3.7 Flash, которое применимо ко всем учетным записям. Google измеряет ограничения, используя запросы в минуту, токены в минуту и запросы в день, применяет их на проект, а не на ключ API, и корректирует их в зависимости от уровня использования и статуса учетной записи. Google рекомендует проверять активные ограничения для проекта непосредственно в AI Studio. Пакетный трафик имеет отдельные ограничения; например, задокументированная очередь пакетов Уровня 1 позволяет ставить в очередь 3 000 000 токенов для Gemini 3.7 Flash.
Окно контекста, модальности и поддерживаемые инструменты
Базовый интерфейс API знаком любому, кто уже использует 3.6 Flash: входной контекст на 1 048 576 токенов и максимальный текстовый вывод на 65 536 токенов. Модель может принимать текст, изображения, видео, аудио и PDF-документы, но сама не генерирует изображения или аудио.
| Возможность | Статус в Gemini 3.7 Flash |
|---|---|
| Кэширование | Поддерживается |
| Выполнение кода | Поддерживается |
| Использование компьютера | Поддерживается в предварительной версии |
| Поиск файлов | Поддерживается |
| Вызов функций | Поддерживается |
| Привязка поиска Google | Поддерживается |
| Привязка Google Карт | Поддерживается |
| Структурированные выходные данные | Поддерживается |
| Контекст URL | Поддерживается |
| Уровни мышления | Низкий, средний и высокий |
| Прямой API | Не поддерживается |
| Генерация изображений | Не поддерживается |
| Генерация аудио | Не поддерживается |
Одна из ловушек при миграции — это настройка мышления. Gemini 3.7 Flash поддерживает низкий, средний и высокий уровни. Google Cloud документирует средний уровень как значение по умолчанию в своей платформе Enterprise Agent Platform, в то время как явная установка минимальных значений приводит к ошибке проверки. Приложения, которые ранее использовали минимальные настройки, должны сопоставить это поведение с поддерживаемым уровнем и повторно измерить задержку и качество выходных данных.

Источник: pexels.com
Что означают изменения на практике
Для кодирующих агентов
Gemini 3.7 Flash имеет наиболее сильный сценарий обновления, когда приложение выполняет долгосрочное кодирование, а не изолированные фрагменты. Улучшения в DeepSWE, FrontierCode и Terminal-bench указывают в одном направлении: модель лучше справляется с многоэтапными инженерными задачами. Google также заявляет, что модель более дисциплинированно адаптируется к препятствиям и уточняет намерения, что может иметь значение, когда агент имеет разрешение редактировать файлы или многократно вызывать инструменты.
Для рабочих процессов с документами и знаниями
Оконный контекст объемом в миллион токенов не изменился, но качество работы с плотным материалом, по-видимому, улучшилось в оценках выпуска. Это делает 3.7 Flash более сильным кандидатом для годовых отчетов, конвейеров юридических документов, научной литературы, внутренних баз знаний и смешанных рабочих процессов с PDF. Однако огромное оконное окно контекста не означает идеального извлечения; системы извлечения, поиск файлов и сегментация запросов по-прежнему могут быть более надежными и дешевыми, чем отправка всего содержимого при каждом запросе.
Для веб-разработки
Google подчеркивает более высокую точность кода при первом проходе, более функциональные макеты и меньшее количество запросов для создания полноценных приложений. Показатель Elo в Code Arena — 1588 — является наиболее четким опубликованным индикатором. Команды по-прежнему должны самостоятельно оценивать соответствие дизайну, поведение браузера, доступность и соглашения, специфичные для фреймворка, на своем собственном кодовом базе, поскольку агрегированный веб-бенчмарк не может представлять каждую фронтенд-стек.
Для простых задач с большим объемом
Не предполагайте, что 3.7 Flash заменит каждую более дешевую модель. Если рабочая нагрузка заключается в классификации, извлечении или шаблонной трансформации при очень большом объеме, модель Flash-Lite может по-прежнему выигрывать по стоимости и пропускной способности. Цель 3.7 Flash — продвинуть более сильное мышление и агентскую производительность в сегмент Flash, а не стать самым дешевым вариантом для каждого запроса.
Стоит ли переходить с Gemini 3.6 Flash?
| Рабочая нагрузка | Рекомендуемое направление | Почему |
|---|---|---|
| Агент кодирования на уровне репозитория | Активно тестируйте 3.7 Flash | Большие опубликованные достижения в DeepSWE и FrontierCode |
| Автоматизация бизнес-процессов | Тестируйте 3.7 Flash | AutomationBench улучшается с 17,0% до 30,4% |
| Анализ PDF и документов | Тестируйте 3.7 Flash | Более высокие результаты GDP.pdf и длинного контекста |
| Существующий стабильный конвейер 3.6 Flash | Проведите бенчмаркинг перед переключением | Текущие вводные тарифы за токен одинаковы, поэтому качество, задержка и стоимость задачи должны быть решающими |
| Высокообъемное простое извлечение | Сравните с Flash-Lite | Более легкая модель может по-прежнему иметь лучший профиль пропускной способности/стоимости |
| Приложение голосовой связи в реальном времени | Используйте модель, совместимую с Live API | Gemini 3.7 Flash не поддерживает Live API |
| Генерация изображений или аудио | Используйте другую модель | 3.7 Flash выдает текстовый вывод, а не сгенерированные изображения или аудио |
Чек-лист миграции для Gemini 3.7 Flash
- Измените целевую модель на
gemini-3.7-flashсначала в тестовой среде. - Просмотрите настройку мышления. Не отправляйте
minimal; выберите низкий, средний или высокий. - Повторно запустите тесты вызова функций, проверку структурированных выходных данных и проверки разрешений инструментов.
- Тестируйте рабочие процессы с длинным контекстом и PDF с теми же репрезентативными документами, что и в производственной среде.
- Измерьте успешное завершение задач, задержку, входные токены, выходные и мыслительные токены, повторные попытки, ходы и вызовы инструментов.
- Включите стоимость привязки и кэширования при сравнении общей стоимости задачи.
- Разворачивайте постепенно и сохраняйте протестированный путь отката к существующей производственной модели.
Ограничения, которые следует учитывать
Карта модели Google DeepMind перечисляет стандартные ограничения базовых моделей, включая галлюцинации, и отмечает, что иногда могут возникать проблемы с медленной работой или тайм-аутом. Она устанавливает дату среза знаний для Gemini 3.7 Flash на март 2026 года, предупреждая, что некоторые области могут фактически быть ограничены январем 2025 года. Поэтому текущая информация по-прежнему требует привязки или извлечения из актуальных источников, когда важна свежесть.
Использование компьютера помечено как предварительная версия, поэтому приложения должны ограничивать разрешения, проверять действия и сохранять подтверждение от человека для ответственных шагов. Модели также не хватает Live API, генерации изображений и генерации аудио. Наконец, привлекательное стартовое ценообразование явно временное; приложения со значительным использованием в 2027 году должны рассчитывать бюджет исходя из тарифов после акций, а не предполагать, что цены августа 2026 года сохранятся.Техническое сравнение Gemini и Claude предоставляет дополнительный контекст. Поскольку версии моделей и цены быстро меняются, используйте актуальную документацию поставщика для принятия решений о закупках и проводите бенчмаркинг точных моделей, которые вы планируете развернуть.
Часто задаваемые вопросы
Когда был выпущен Gemini 3.7 Flash?
Google анонсировал и выпустил Gemini 3.7 Flash 13 августа 2026 года. Google Cloud указывает стабильную модель как общедоступную, а не только в предварительной версии.
Каково имя модели API Gemini 3.7 Flash?
Идентификатор стабильной модели — gemini-3.7-flash. Google указывает этот точный идентификатор как в документации модели Gemini API, так и в документации корпоративной модели.
Сколько стоит Gemini 3.7 Flash?
До 31 декабря 2026 года стандартное платное использование API составляет 0,75 доллара за миллион входных токенов и 3,75 доллара за миллион выходных токенов, включая токены мышления. Начиная с 1 января 2027 года эти тарифы вырастут до 1,50 и 7,50 доллара. Для пакетной, Flex и Priority существуют отдельные тарифы.
Является ли Gemini 3.7 Flash дешевле Gemini 3.6 Flash?
Не по текущим вводным тарифам за токен. В карте модели Google от августа 2026 года Gemini 3.6 Flash и Gemini 3.7 Flash указаны по цене 0,75 доллара за миллион входных токенов и 3,75 доллара за миллион выходных токенов до 31 декабря 2026 года. Формулировка Google о «половине стоимости» при запуске сравнивает 3.7 с первоначальной ценой запуска 3.6 Flash.
Доступен ли Gemini 3.7 Flash в API?
Да. Он доступен через Gemini API и Google AI Studio со стабильным идентификатором модели gemini-3.7-flash. Google также распространяет его через Antigravity и корпоративные продукты Gemini.
Каково оконное окно контекста Gemini 3.7 Flash?
Лимит входных токенов составляет 1 048 576 токенов, а максимальный выход — 65 536 токенов. Входные данные могут включать текст, изображения, видео, аудио и документы PDF; выходные данные — текст.
Поддерживает ли Gemini 3.7 Flash Live API?
Нет. Документация Google по моделям указывает, что Live API не поддерживается. Приложения, требующие нативного взаимодействия с голосом в реальном времени, должны выбирать модель, совместимую с Live API.
Лучше ли Gemini 3.7 Flash, чем Gemini 3.6 Flash?
Опубликованные Google оценки показывают существенные улучшения по нескольким бенчмаркам, связанным с кодированием, автоматизацией, PDF, длинным контекстом и использованием компьютера, но не все бенчмарки улучшаются. Практический ответ зависит от рабочей нагрузки, целевой задержки, поведения инструментов и стоимости за успешную задачу, поэтому производственные команды должны проводить собственные репрезентативные оценки.
Итог
Gemini 3.7 Flash — это значительное обновление для наиболее важной для разработчиков части семейства Flash: многошагового кодирования, агентов, автоматизации и рабочих процессов, связанных с большими объемами документов. Самые значительные опубликованные улучшения Google — это не просто небольшие сдвиги в таблицах лидеров; DeepSWE растет с 48,6% до 65,3%, AutomationBench с 17,0% до 30,4%, а GDP.pdf с 22,0% до 34,0%, при этом модель сохраняет то же окно контекста в миллион токенов и широкую поддержку инструментов Gemini.
Стоимость также имеет одинаково важное значение. Стандартное использование API временно составляет 0,75 доллара США за миллион входных токенов и 3,75 доллара США за миллион выходных токенов, но эти ставки удвоятся 1 января 2027 года. Поэтому для команд, уже использующих Gemini 3.6 Flash, лучшей причиной для миграции является лучшая производительность задач по той же текущей вводной ставке за токен, а не постоянное снижение цены. Протестируйте 3.7 Flash на реальных рабочих нагрузках, включите в расчет затраты на инструменты и повторные попытки и примите решение о миграции, основываясь на стоимости и надежности успешной задачи, а не только на названии модели.