Gemini 3.7 Flash: бенчмарки, цены, доступность API и что изменилось

Avatar
Лиза Эрнст · 17.08.2026 · Искусственный интеллект · 15 минут чтения

Google выпустила Gemini 3.7 Flash 13 августа 2026 года, всего через три недели после Gemini 3.6 Flash. Обновление нацелено в первую очередь на кодирование, агентские рабочие процессы, веб-разработку и работу с документами, требующую больших знаний. Google опубликовала существенные улучшения по сравнению с 3.6 Flash по нескольким показателям программной инженерии и автоматизации.

Необычная часть — цены: Gemini 3.7 Flash запускается по цене 0,75 доллара за миллион входных токенов и 3,75 доллара за миллион выходных токенов через стандартный платный API до 31 декабря 2026 года. Эти тарифы временные и удвоятся 1 января 2027 года. В этом руководстве объясняются результаты тестов, доступность API, лимиты модели, поддерживаемые инструменты, уровни цен и практические отличия от Gemini 3.6 Flash.

Ключевые выводы

Gemini 3.7 Flash вкратце

Спецификация Gemini 3.7 Flash
Дата выпуска 13 августа 2026 года
Стадия запуска Общедоступен (GA)
Идентификатор стабильной модели API gemini-3.7-flash
Входные модальности Текст, изображение, видео, аудио и PDF
Выходная модальность Текст
Лимит входных токенов 1 048 576 токенов
Максимальный выход 65 536 токенов
Уровни мышления Низкий, средний и высокий; минимальный не поддерживается
Цена стандартного платного API до 31 декабря 2026 г. 0,75 долл. США / 1 млн входных токенов; 3,75 долл. США / 1 млн выходных токенов

Что такое Gemini 3.7 Flash?

Gemini 3.7 Flash — это следующая итерация семейства Gemini 3 Flash от Google. Google DeepMind заявляет, что он основан на Gemini 3.6 Flash и добавляет алгоритмические улучшения в основную основу рассуждений модели. Позиционирование также стало более явным: Google называет 3.7 Flash своим основным "рабочей лошадкой" для кодирования и агентов, а не моделью, предназначенной просто для максимизации пропускной способности.

Это различие имеет значение. Модели Flash традиционно выбирались потому, что они быстрее и дешевле, чем самые мощные модели рассуждений. С 3.7 Google пытается перенести больше многоэтапных задач на этот экономичный уровень: кодирование на уровне репозитория, взаимодействие с браузером или компьютером, вызов функций, сложная обработка документов и бизнес-процессы, требующие нескольких вызовов инструментов перед завершением ответа.

Если вы пришли от предшественника, обзор Gemini 3.6 Flash предоставляет контекст выпуска предыдущей модели. Важное обновление теперь заключается в том, что 3.7 Flash сохраняет то же окно контекста в миллион токенов и широкий набор инструментов, одновременно повышая производительность по многим опубликованным Google оценкам агентов и кодирования.

Что изменилось по сравнению с Gemini 3.6 Flash?

Область Изменение Gemini 3.7 Flash Практический эффект
Кодирование Более высокие результаты FrontierCode, DeepSWE и Terminal-bench Более убедительный случай для работы с репозиториями, отладки и долгосрочных кодирующих агентов
Веб-разработка Code Arena вырос с 1538 до 1588 Elo в карточке модели Google Лучшая опубликованная производительность на функциональных макетах и ​​полных веб-задачах
Корпоративная автоматизация AutomationBench вырос с 17,0% до 30,4% Более перспективно для рабочих процессов, сочетающих рассуждения, инструменты и бизнес-системы
Рассуждение по документам GDP.pdf вырос с 22,0% до 34,0% Улучшенный опубликованный результат для сложной работы со знаниями на основе PDF
Длинный контекст GDM-MRCR v2 при 128 тыс. вырос с 91,8% до 97,0% Лучшее извлечение и рассуждение по длинным входным данным в этой оценке
Поведение разработчика Google утверждает, что модель лучше адаптируется к препятствиям, уточняет намерения и более добросовестно следует инструкциям Потенциально меньше повторных попыток и меньше ручного надзора в многоэтапных рабочих процессах
Цены 3.7 запускается по временной ставке 0,75 доллара за вход / 3,75 доллара за выход за 1 миллион токенов Более низкая краткосрочная стоимость, чем первоначальная ставка запуска 3.6, хотя 3.6 теперь имеет ту же временную ставку

Последнюю строку легко неверно истолковать. Google описывает Gemini 3.7 Flash как запущенный вдвое дешевле, чем первоначальная стоимость Gemini 3.6 Flash. Однако текущая карточка модели Google перечисляет как 3.6 Flash, так и 3.7 Flash по цене 0,75 доллара за вход и 3,75 доллара за выход за миллион токенов в рамках той же временной акции. Таким образом, 3.7 в настоящее время не дешевле за стандартный токен, чем 3.6; сравнение ведется с первоначальной ценой запуска 3.6.

Бенчмарки Gemini 3.7 Flash

Карточка модели Google от августа 2026 года публикует широкий набор тестов, охватывающих программную инженерию, агентское использование терминала, корпоративную автоматизацию, работу со знаниями, PDF, длинный контекст, использование компьютера и научные рассуждения. Цифры ниже сравнивают Gemini 3.7 Flash с Gemini 3.6 Flash, используя значения из этой карточки модели.

Бенчмарк Что он измеряет Gemini 3.6 Flash Gemini 3.7 Flash
Индекс искусственного анализа интеллекта Интеллект составной модели 52 56
FrontierCode 1.1 Основная Качество производственного кода 34.4% 43.6%
DeepSWE v1.1 Инженерия программного обеспечения на большом горизонте 48.6% 65.3%
Code Arena Веб-разработка 1538 Elo 1588 Elo
Terminal-bench 2.1 Агентное кодирование в терминале 78.0% 85.8%
AutomationBench Автоматизация корпоративных рабочих процессов 17.0% 30.4%
GDP.pdf Экспертное понимание PDF 22.0% 34.0%
GDM-MRCR v2 при 128k Извлечение информации и рассуждения в большом контексте 91.8% 97.0%
OSWorld-2.0 Агентное использование компьютера 33.8% 47.9%
Таблица сравнения Google, сравнивающая Gemini 3.7 Flash с Gemini 3.6 Flash и другими моделями ИИ

Источник: blog.google

Таблица оценки Google от августа 2026 года показывает особенно большие достижения 3.7 Flash в инженерии программного обеспечения на большом горизонте, автоматизации корпоративных рабочих процессов, понимании документов и использовании компьютера. Тесты измеряют различные рабочие нагрузки и не должны объединяться в один универсальный показатель.

Где улучшения наиболее заметны

Наиболее явные изменения наблюдаются в рабочих нагрузках, которые требуют от модели постоянной работы, а не однократного ответа. DeepSWE поднимается с 48,6% до 65,3%, в то время как AutomationBench перемещается с 17,0% до 30,4%. Это подтверждает заявление Google о том, что модель более полезна для агентов, которым необходимо планировать, использовать инструменты, проверять результаты и преодолевать препятствия.

Работа с документами также значительно улучшается по опубликованным данным Google. GDP.pdf перемещается с 22,0% до 34,0%, и компания особо выделяет финансы, юриспруденцию и бионауки как области с высокой плотностью знаний, где ожидается лучшее рассуждение. Это не означает, что модель может заменить экспертную оценку в регулируемых или ответственных работах; это означает, что результат теста материально выше, чем у 3.6 Flash на протестированных задачах.

3.7 Flash не выигрывает во всех тестах

Выпуск не является полным триумфом. На CharXiv без инструментов Gemini 3.7 Flash набирает 84,5% по сравнению с 85,2% у 3.6 Flash; с инструментами он набирает 88,7% по сравнению с 89,4%. В таблице кросс-модельных сравнений Google GPT-5.6 Terra также остается впереди по некоторым оценкам кодирования и терминалов. Именно поэтому таблицу сравнения следует использовать для выявления перспективных рабочих нагрузок, а не для объявления универсального победителя.

Также стоит отметить небольшое расхождение в отчетности: в статье о запуске Google результат DeepSWE для Gemini 3.6 Flash округляется до 49,0%, в то время как в подробной карточке модели DeepMind указано 48,6%. В этой статье используется более точное значение карточки модели в сравнительной таблице.

График стоимости и производительности Google для Gemini 3.7 Flash на DeepSWE v1.1

Источник: blog.google

Google также представляет выпуск, ориентируясь на стоимость за выполненную задачу программной инженерии, а не только на цену за токен. Это правильный производственный показатель для агентов: повторные попытки, токены для рассуждений и повторные вызовы инструментов могут иметь большее значение, чем заголовочные ставки токенов.

Цены Gemini 3.7 Flash

Gemini 3.7 Flash имеет ограниченный по времени график ценообразования. Текущие вводные тарифы действуют до 31 декабря 2026 года. Документация по ценам Google затем удваивает тарифы на токены 1 января 2027 года.

Вариант потребления Входные данные / 1 млн токенов до 31 декабря 2026 г. Выходные данные / 1 млн токенов до 31 декабря 2026 г. Входные/выходные данные с 1 января 2027 г.
Стандартная оплата $0.75 $3.75 $1.50 / $7.50
Пакетная $0.375 $1.875 $0.75 / $3.75
Flex $0.375 $1.875 $0.75 / $3.75
Приоритет $1.35 $6.75 $2.70 / $13.50

Цены на выходные данные включают токены для размышлений. Стандартное кэширование контекста стоит 0,075 доллара за миллион кэшированных токенов в течение вводного периода, плюс 0,50 доллара за миллион токенов в час за хранение кэша; эти тарифы также удваиваются в 2027 году. Заземление Google Поиск и заземление Google Карты могут взиматься отдельно после общего ежемесячного лимита, описанного в документации по ценам Google.

Стандартный API также имеет бесплатный уровень, указанный как бесплатный. Его не следует рассматривать как гарантированную производственную мощность: ограничения скорости зависят от модели, проекта, уровня использования и статуса учетной записи, и Google явно заявляет, что опубликованные ограничения не гарантируются. Для платных производственных рабочих нагрузок стоимость модели — лишь часть бюджета; заземление, внешние API, хранение и неудачные или повторяющиеся шаги агента могут изменить общую сумму.

Примерные стандартные затраты на API

Ежемесячное использование токенов Оценочная стоимость до 31 декабря 2026 г. Оценочная стоимость с 1 января 2027 г.
10 млн входных + 2 млн выходных $15.00 $30.00
50 млн входных + 5 млн выходных $56.25 $112.50
100 млн входных + 20 млн выходных $150.00 $300.00

Эти примеры включают только входные и выходные токены модели. Они не включают заземление, хранение кэша, внешние службы или инфраструктуру приложения.

Доступность Gemini 3.7 Flash API

Gemini 3.7 Flash — это не анонс только для предварительного просмотра. Google Cloud перечисляет gemini-3.7-flash как GA с датой выпуска 13 августа 2026 года, а документация Gemini API определяет ту же строку как стабильную версию модели.

Группа пользователей Где доступен Gemini 3.7 Flash Важная деталь
Разработчики API Gemini API и Google AI Studio Используйте стабильный идентификатор модели gemini-3.7-flash
Разработчики Android Android Studio Google перечисляет Android Studio как поверхность запуска для разработчиков
Разработчики агентов Google Antigravity Разработан для кодирования, ориентированного на агентов, и многошаговых рабочих процессов
Предприятия Gemini Enterprise Agent Platform и приложение Gemini Enterprise Применяется корпоративное управление, биллинг и региональные контроли
Частные лица Gemini Spark в приложении Gemini Google утверждает, что Spark использует 3.7 Flash для подписчиков Google AI Pro и Ultra в более чем 160 поддерживаемых странах

Для разработчиков, которые еще не настроили доступ, руководство по ключам API Gemini охватывает настройку Google AI Studio. После готовности доступа критическим изменением для развертывания является идентификатор модели; миграция в производственную среду по-прежнему должна включать регрессионные тесты для инструментов, схем, задержек и общего использования токенов.

Разработчик, работающий с исходным кодом на ноутбуке

Источник: pexels.com

Переход на новый идентификатор модели — легкая часть. Более безопасная миграция заключается в тестировании репрезентативных задач кодирования и агентских задач в staging-среде, записи успешности задач, задержек, использования токенов, повторных попыток и вызовов инструментов, и только затем в переключении производственного трафика.

Ограничения скорости специфичны для проекта

Не существует единого числа RPM или TPM для Gemini 3.7 Flash, которое применимо ко всем учетным записям. Google измеряет ограничения, используя запросы в минуту, токены в минуту и запросы в день, применяет их на проект, а не на ключ API, и корректирует их в зависимости от уровня использования и статуса учетной записи. Google рекомендует проверять активные ограничения для проекта непосредственно в AI Studio. Пакетный трафик имеет отдельные ограничения; например, задокументированная очередь пакетов Уровня 1 позволяет ставить в очередь 3 000 000 токенов для Gemini 3.7 Flash.

Окно контекста, модальности и поддерживаемые инструменты

Базовый интерфейс API знаком любому, кто уже использует 3.6 Flash: входной контекст на 1 048 576 токенов и максимальный текстовый вывод на 65 536 токенов. Модель может принимать текст, изображения, видео, аудио и PDF-документы, но сама не генерирует изображения или аудио.

Возможность Статус в Gemini 3.7 Flash
Кэширование Поддерживается
Выполнение кода Поддерживается
Использование компьютера Поддерживается в предварительной версии
Поиск файлов Поддерживается
Вызов функций Поддерживается
Привязка поиска Google Поддерживается
Привязка Google Карт Поддерживается
Структурированные выходные данные Поддерживается
Контекст URL Поддерживается
Уровни мышления Низкий, средний и высокий
Прямой API Не поддерживается
Генерация изображений Не поддерживается
Генерация аудио Не поддерживается

Одна из ловушек при миграции — это настройка мышления. Gemini 3.7 Flash поддерживает низкий, средний и высокий уровни. Google Cloud документирует средний уровень как значение по умолчанию в своей платформе Enterprise Agent Platform, в то время как явная установка минимальных значений приводит к ошибке проверки. Приложения, которые ранее использовали минимальные настройки, должны сопоставить это поведение с поддерживаемым уровнем и повторно измерить задержку и качество выходных данных.

Офисные работники просматривают документы рядом с ноутбуком

Источник: pexels.com

Gemini 3.7 Flash улучшает опубликованные Google результаты работы с PDF и знаниями, что актуально для рабочих процессов, связанных с большим количеством документов. Более высокий показатель в бенчмарке не устраняет риск галлюцинаций, поэтому важные извлеченные факты и последующие решения по-прежнему требуют проверки.

Что означают изменения на практике

Для кодирующих агентов

Gemini 3.7 Flash имеет наиболее сильный сценарий обновления, когда приложение выполняет долгосрочное кодирование, а не изолированные фрагменты. Улучшения в DeepSWE, FrontierCode и Terminal-bench указывают в одном направлении: модель лучше справляется с многоэтапными инженерными задачами. Google также заявляет, что модель более дисциплинированно адаптируется к препятствиям и уточняет намерения, что может иметь значение, когда агент имеет разрешение редактировать файлы или многократно вызывать инструменты.

Для рабочих процессов с документами и знаниями

Оконный контекст объемом в миллион токенов не изменился, но качество работы с плотным материалом, по-видимому, улучшилось в оценках выпуска. Это делает 3.7 Flash более сильным кандидатом для годовых отчетов, конвейеров юридических документов, научной литературы, внутренних баз знаний и смешанных рабочих процессов с PDF. Однако огромное оконное окно контекста не означает идеального извлечения; системы извлечения, поиск файлов и сегментация запросов по-прежнему могут быть более надежными и дешевыми, чем отправка всего содержимого при каждом запросе.

Для веб-разработки

Google подчеркивает более высокую точность кода при первом проходе, более функциональные макеты и меньшее количество запросов для создания полноценных приложений. Показатель Elo в Code Arena — 1588 — является наиболее четким опубликованным индикатором. Команды по-прежнему должны самостоятельно оценивать соответствие дизайну, поведение браузера, доступность и соглашения, специфичные для фреймворка, на своем собственном кодовом базе, поскольку агрегированный веб-бенчмарк не может представлять каждую фронтенд-стек.

Для простых задач с большим объемом

Не предполагайте, что 3.7 Flash заменит каждую более дешевую модель. Если рабочая нагрузка заключается в классификации, извлечении или шаблонной трансформации при очень большом объеме, модель Flash-Lite может по-прежнему выигрывать по стоимости и пропускной способности. Цель 3.7 Flash — продвинуть более сильное мышление и агентскую производительность в сегмент Flash, а не стать самым дешевым вариантом для каждого запроса.

Стоит ли переходить с Gemini 3.6 Flash?

Рабочая нагрузка Рекомендуемое направление Почему
Агент кодирования на уровне репозитория Активно тестируйте 3.7 Flash Большие опубликованные достижения в DeepSWE и FrontierCode
Автоматизация бизнес-процессов Тестируйте 3.7 Flash AutomationBench улучшается с 17,0% до 30,4%
Анализ PDF и документов Тестируйте 3.7 Flash Более высокие результаты GDP.pdf и длинного контекста
Существующий стабильный конвейер 3.6 Flash Проведите бенчмаркинг перед переключением Текущие вводные тарифы за токен одинаковы, поэтому качество, задержка и стоимость задачи должны быть решающими
Высокообъемное простое извлечение Сравните с Flash-Lite Более легкая модель может по-прежнему иметь лучший профиль пропускной способности/стоимости
Приложение голосовой связи в реальном времени Используйте модель, совместимую с Live API Gemini 3.7 Flash не поддерживает Live API
Генерация изображений или аудио Используйте другую модель 3.7 Flash выдает текстовый вывод, а не сгенерированные изображения или аудио

Чек-лист миграции для Gemini 3.7 Flash

  1. Измените целевую модель на gemini-3.7-flash сначала в тестовой среде.
  2. Просмотрите настройку мышления. Не отправляйте minimal; выберите низкий, средний или высокий.
  3. Повторно запустите тесты вызова функций, проверку структурированных выходных данных и проверки разрешений инструментов.
  4. Тестируйте рабочие процессы с длинным контекстом и PDF с теми же репрезентативными документами, что и в производственной среде.
  5. Измерьте успешное завершение задач, задержку, входные токены, выходные и мыслительные токены, повторные попытки, ходы и вызовы инструментов.
  6. Включите стоимость привязки и кэширования при сравнении общей стоимости задачи.
  7. Разворачивайте постепенно и сохраняйте протестированный путь отката к существующей производственной модели.

Ограничения, которые следует учитывать

Карта модели Google DeepMind перечисляет стандартные ограничения базовых моделей, включая галлюцинации, и отмечает, что иногда могут возникать проблемы с медленной работой или тайм-аутом. Она устанавливает дату среза знаний для Gemini 3.7 Flash на март 2026 года, предупреждая, что некоторые области могут фактически быть ограничены январем 2025 года. Поэтому текущая информация по-прежнему требует привязки или извлечения из актуальных источников, когда важна свежесть.

Использование компьютера помечено как предварительная версия, поэтому приложения должны ограничивать разрешения, проверять действия и сохранять подтверждение от человека для ответственных шагов. Модели также не хватает Live API, генерации изображений и генерации аудио. Наконец, привлекательное стартовое ценообразование явно временное; приложения со значительным использованием в 2027 году должны рассчитывать бюджет исходя из тарифов после акций, а не предполагать, что цены августа 2026 года сохранятся.Техническое сравнение Gemini и Claude предоставляет дополнительный контекст. Поскольку версии моделей и цены быстро меняются, используйте актуальную документацию поставщика для принятия решений о закупках и проводите бенчмаркинг точных моделей, которые вы планируете развернуть.

Часто задаваемые вопросы

Когда был выпущен Gemini 3.7 Flash?

Google анонсировал и выпустил Gemini 3.7 Flash 13 августа 2026 года. Google Cloud указывает стабильную модель как общедоступную, а не только в предварительной версии.

Каково имя модели API Gemini 3.7 Flash?

Идентификатор стабильной модели — gemini-3.7-flash. Google указывает этот точный идентификатор как в документации модели Gemini API, так и в документации корпоративной модели.

Сколько стоит Gemini 3.7 Flash?

До 31 декабря 2026 года стандартное платное использование API составляет 0,75 доллара за миллион входных токенов и 3,75 доллара за миллион выходных токенов, включая токены мышления. Начиная с 1 января 2027 года эти тарифы вырастут до 1,50 и 7,50 доллара. Для пакетной, Flex и Priority существуют отдельные тарифы.

Является ли Gemini 3.7 Flash дешевле Gemini 3.6 Flash?

Не по текущим вводным тарифам за токен. В карте модели Google от августа 2026 года Gemini 3.6 Flash и Gemini 3.7 Flash указаны по цене 0,75 доллара за миллион входных токенов и 3,75 доллара за миллион выходных токенов до 31 декабря 2026 года. Формулировка Google о «половине стоимости» при запуске сравнивает 3.7 с первоначальной ценой запуска 3.6 Flash.

Доступен ли Gemini 3.7 Flash в API?

Да. Он доступен через Gemini API и Google AI Studio со стабильным идентификатором модели gemini-3.7-flash. Google также распространяет его через Antigravity и корпоративные продукты Gemini.

Каково оконное окно контекста Gemini 3.7 Flash?

Лимит входных токенов составляет 1 048 576 токенов, а максимальный выход — 65 536 токенов. Входные данные могут включать текст, изображения, видео, аудио и документы PDF; выходные данные — текст.

Поддерживает ли Gemini 3.7 Flash Live API?

Нет. Документация Google по моделям указывает, что Live API не поддерживается. Приложения, требующие нативного взаимодействия с голосом в реальном времени, должны выбирать модель, совместимую с Live API.

Лучше ли Gemini 3.7 Flash, чем Gemini 3.6 Flash?

Опубликованные Google оценки показывают существенные улучшения по нескольким бенчмаркам, связанным с кодированием, автоматизацией, PDF, длинным контекстом и использованием компьютера, но не все бенчмарки улучшаются. Практический ответ зависит от рабочей нагрузки, целевой задержки, поведения инструментов и стоимости за успешную задачу, поэтому производственные команды должны проводить собственные репрезентативные оценки.

Итог

Gemini 3.7 Flash — это значительное обновление для наиболее важной для разработчиков части семейства Flash: многошагового кодирования, агентов, автоматизации и рабочих процессов, связанных с большими объемами документов. Самые значительные опубликованные улучшения Google — это не просто небольшие сдвиги в таблицах лидеров; DeepSWE растет с 48,6% до 65,3%, AutomationBench с 17,0% до 30,4%, а GDP.pdf с 22,0% до 34,0%, при этом модель сохраняет то же окно контекста в миллион токенов и широкую поддержку инструментов Gemini.

Стоимость также имеет одинаково важное значение. Стандартное использование API временно составляет 0,75 доллара США за миллион входных токенов и 3,75 доллара США за миллион выходных токенов, но эти ставки удвоятся 1 января 2027 года. Поэтому для команд, уже использующих Gemini 3.6 Flash, лучшей причиной для миграции является лучшая производительность задач по той же текущей вводной ставке за токен, а не постоянное снижение цены. Протестируйте 3.7 Flash на реальных рабочих нагрузках, включите в расчет затраты на инструменты и повторные попытки и примите решение о миграции, основываясь на стоимости и надежности успешной задачи, а не только на названии модели.

Поделитесь нашей статьёй!
Источники