Google выпустила Gemini 3.8 Flash — третью Flash-модель за шесть недель, всего через три недели после Gemini 3.7 Flash. Вводная цена совпадает с предыдущей версией, но на сложных задачах модель работает больше: делает больше шагов рассуждений, чаще вызывает инструменты и тратит больше токенов, а для экономных сценариев оставлены пониженные уровни effort и полная поддержка 3.7 Flash. Одновременно представлена Gemini 3.8 Flash Cyber для автономного поиска и залатывания уязвимостей, показавшая уровень фронтира на CyberGym, однако её распространение ограничено программой Fairwind.

image
image
image

Что произошло

Google представила Gemini 3.8 Flash всего через три недели после Gemini 3.7 Flash — это третья Flash-модель за последние шесть недель. Вводный тариф совпадает с 3.7 Flash: $0.75 за миллион входных и $3.75 за миллион выходных токенов до 31 декабря 2026 года, затем $1.50 и $7.50 соответственно. Модель набирает 54.9% на HLE-Verified, принимает контекст до 1 млн токенов, выдаёт до 64K токенов и знает мир на март 2026 года. Параллельно выпущена Gemini 3.8 Flash Cyber для автономного поиска и залатывания уязвимостей: на CyberGym она превосходит 3.5 Flash Cyber и более крупные модели, показывая 47.2% pass@1 на CWE-Bench на Парето-границе против 47.8% у ведущей модели при заметно меньшей цене, демонстрирует более 70% успеха на внутреннем бенчмарке по 20 языкам программирования и нашла критическую уязвимость в Google Cloud менее чем за два часа вместо месяцев.

Контекст

Релиз закрепляет переход Google к почти ежемесячному выпуску дешёвых рабочих моделей: третий Flash-релиз за шесть недель означает, что между выпусками почти не остаётся времени на независимые воспроизведения и сравнительные прогоны. Экономический смысл релиза в том, что прирост качества при неизменной цене за токен достигается увеличенным расходом вычислений на сложных задачах, поэтому корректной метрикой сравнения моделей становится не цена за токен, а цена за решённую задачу. Google при этом прямо оставляет экономным пользователям пониженные уровни effort и полную поддержку 3.7 Flash, признавая, что новая модель нужна не во всех сценариях. Кибербезопасность оформлена как отдельный продуктовый трек с закрытым распространением — по той же логике ограниченного доступа, что у cyber-моделей Anthropic и OpenAI: передовые результаты в dual-use области демонстрируются на вендорских и внутренних бенчмарках, а доступ распределяется по заявкам.

Почему это важно для индустрии

Для индустрии релиз — это не новый уровень цены, а новая ручка качества: при неизменном тарифе за токен обязательными элементами продуктов на LLM становятся уровни effort, телеметрия расхода токенов и маршрутизация дешёвых запросов на 3.7 Flash, которая остаётся полностью поддерживаемой. Стартапы получают прирост возможностей Flash-класса — контекст до 1 млн токенов и выход до 64K позволяют работать с целыми кодовыми базами и длинными документами, — но платят за это предсказуемостью счёта: выигрывают те, кто считает стоимость на своих задачах. Если каденс «Flash-модель каждые несколько недель» сохранится, разовые миграции заменятся постоянным eval-конвейером с регрессионными наборами на реальных задачах, автоматическим сравнением версий и роутингом по стоимости решённой задачи. К концу вводного периода 31 декабря 2026 года, когда истечёт сниженный тариф, команды без таких расчётов рискуют столкнуться с ростом расходов, а юнит-экономика продуктов будет считаться в решённых задачах, а не в токенах; ожидаема и волна инструментов вокруг автовыбора модели и уровня effort, телеметрии затрат и регресс-тестов качества.

Почему это важно для пользователей

Попробовать Gemini 3.8 Flash можно уже сегодня в Gemini API и Google AI Studio, а также в Antigravity, Android Studio, Gemini Enterprise и приложении Gemini по подписке AI Pro или Ultra. Цена за токен не изменилась, однако на сложных задачах счёт может вырасти из-за повышенного расхода токенов, поэтому при работе с API стоит задать уровни effort по умолчанию и отслеживать фактический расход на сессию, а перед переносом пайплайнов с 3.7 на 3.8 — замерить стоимость решённой задачи на своих данных, а не ориентироваться на тариф. Миграция не навязана: 3.7 Flash полностью поддерживается, и для экономных сценариев на ней можно остаться. Контекст до 1 млн токенов и выход до 64K открывают сценарии с длинными документами и целыми кодовыми базами уже сейчас. Gemini 3.8 Flash Cyber обычным разработчикам недоступна — доступ распределяется по заявкам через программу Fairwind.

Что пока неизвестно / ограничения

Ключевая цифра 54.9% на HLE-Verified дана без протокола оценки: в источниках не раскрыты подмножества задач, настройка effort и число прогонов, поэтому результат стоит считать вендорским отчётом, а не воспроизведённым; независимых сторонних прогонов пока нет, а частый каденс релизов оставляет мало времени на их появление. Данных по латентности в источниках нет вовсе — для real-time сервисов потребуются собственные замеры. Результаты Gemini 3.8 Flash Cyber получены на вендорских и внутренних бенчмарках, включая CyberGym и внутренний набор по 20 языкам, а закрытое распространение через программу Fairwind затрудняет независимую проверку этих показателей.

Источники

Автор

Look at AI, редакция