Google выпустила Gemini 3.8 Flash — третью Flash-модель за шесть недель, всего через три недели после Gemini 3.7 Flash. Вводная цена совпадает с предыдущей версией, но на сложных задачах модель работает больше: делает больше шагов рассуждений, чаще вызывает инструменты и тратит больше токенов, а для экономных сценариев оставлены пониженные уровни effort и полная поддержка 3.7 Flash. Одновременно представлена Gemini 3.8 Flash Cyber для автономного поиска и залатывания уязвимостей, показавшая уровень фронтира на CyberGym, однако её распространение ограничено программой Fairwind.



Что произошло
Google представила Gemini 3.8 Flash всего через три недели после Gemini 3.7 Flash — это третья Flash-модель за последние шесть недель. Вводный тариф совпадает с 3.7 Flash: $0.75 за миллион входных и $3.75 за миллион выходных токенов до 31 декабря 2026 года, затем $1.50 и $7.50 соответственно. Модель набирает 54.9% на HLE-Verified, принимает контекст до 1 млн токенов, выдаёт до 64K токенов и знает мир на март 2026 года. Параллельно выпущена Gemini 3.8 Flash Cyber для автономного поиска и залатывания уязвимостей: на CyberGym она превосходит 3.5 Flash Cyber и более крупные модели, показывая 47.2% pass@1 на CWE-Bench на Парето-границе против 47.8% у ведущей модели при заметно меньшей цене, демонстрирует более 70% успеха на внутреннем бенчмарке по 20 языкам программирования и нашла критическую уязвимость в Google Cloud менее чем за два часа вместо месяцев.
Контекст
Релиз закрепляет переход Google к почти ежемесячному выпуску дешёвых рабочих моделей: третий Flash-релиз за шесть недель означает, что между выпусками почти не остаётся времени на независимые воспроизведения и сравнительные прогоны. Экономический смысл релиза в том, что прирост качества при неизменной цене за токен достигается увеличенным расходом вычислений на сложных задачах, поэтому корректной метрикой сравнения моделей становится не цена за токен, а цена за решённую задачу. Google при этом прямо оставляет экономным пользователям пониженные уровни effort и полную поддержку 3.7 Flash, признавая, что новая модель нужна не во всех сценариях. Кибербезопасность оформлена как отдельный продуктовый трек с закрытым распространением — по той же логике ограниченного доступа, что у cyber-моделей Anthropic и OpenAI: передовые результаты в dual-use области демонстрируются на вендорских и внутренних бенчмарках, а доступ распределяется по заявкам.
Почему это важно для индустрии
Для индустрии релиз — это не новый уровень цены, а новая ручка качества: при неизменном тарифе за токен обязательными элементами продуктов на LLM становятся уровни effort, телеметрия расхода токенов и маршрутизация дешёвых запросов на 3.7 Flash, которая остаётся полностью поддерживаемой. Стартапы получают прирост возможностей Flash-класса — контекст до 1 млн токенов и выход до 64K позволяют работать с целыми кодовыми базами и длинными документами, — но платят за это предсказуемостью счёта: выигрывают те, кто считает стоимость на своих задачах. Если каденс «Flash-модель каждые несколько недель» сохранится, разовые миграции заменятся постоянным eval-конвейером с регрессионными наборами на реальных задачах, автоматическим сравнением версий и роутингом по стоимости решённой задачи. К концу вводного периода 31 декабря 2026 года, когда истечёт сниженный тариф, команды без таких расчётов рискуют столкнуться с ростом расходов, а юнит-экономика продуктов будет считаться в решённых задачах, а не в токенах; ожидаема и волна инструментов вокруг автовыбора модели и уровня effort, телеметрии затрат и регресс-тестов качества.
Почему это важно для пользователей
Попробовать Gemini 3.8 Flash можно уже сегодня в Gemini API и Google AI Studio, а также в Antigravity, Android Studio, Gemini Enterprise и приложении Gemini по подписке AI Pro или Ultra. Цена за токен не изменилась, однако на сложных задачах счёт может вырасти из-за повышенного расхода токенов, поэтому при работе с API стоит задать уровни effort по умолчанию и отслеживать фактический расход на сессию, а перед переносом пайплайнов с 3.7 на 3.8 — замерить стоимость решённой задачи на своих данных, а не ориентироваться на тариф. Миграция не навязана: 3.7 Flash полностью поддерживается, и для экономных сценариев на ней можно остаться. Контекст до 1 млн токенов и выход до 64K открывают сценарии с длинными документами и целыми кодовыми базами уже сейчас. Gemini 3.8 Flash Cyber обычным разработчикам недоступна — доступ распределяется по заявкам через программу Fairwind.
Что пока неизвестно / ограничения
Ключевая цифра 54.9% на HLE-Verified дана без протокола оценки: в источниках не раскрыты подмножества задач, настройка effort и число прогонов, поэтому результат стоит считать вендорским отчётом, а не воспроизведённым; независимых сторонних прогонов пока нет, а частый каденс релизов оставляет мало времени на их появление. Данных по латентности в источниках нет вовсе — для real-time сервисов потребуются собственные замеры. Результаты Gemini 3.8 Flash Cyber получены на вендорских и внутренних бенчмарках, включая CyberGym и внутренний набор по 20 языкам, а закрытое распространение через программу Fairwind затрудняет независимую проверку этих показателей.
Источники
- Introducing Gemini 3.8 Flash and 3.8 Flash Cyber — The Keyword, Google
- Gemini 3.8 Flash — Model Card, Google DeepMind
- Fairwind Program — Google DeepMind
Автор
Look at AI, редакция
