← Блог Новости

Gemini 3.8 Flash: что умеет новая модель Google

· · 6 минут чтения
Gemini 3.8 Flash — новая быстрая модель Google

Коротко. 2 сентября 2026 года Google выпустил Gemini 3.8 Flash — четвёртую модель линейки Flash меньше чем за четыре месяца. Предыдущая, 3.7 Flash, вышла всего тремя неделями раньше. Главный прирост — не в «умности вообще», а в агентных задачах: модель дольше думает над сложным запросом, чаще сама вызывает инструменты и заметно лучше держит длинные цепочки шагов. Ниже — что реально изменилось, сколько это стоит и что делать пользователю из России.

Что случилось

Google DeepMind объявил Gemini 3.8 Flash 2 сентября. Flash — это «рабочая лошадка» линейки: модель, которая должна быть быстрой и дешёвой настолько, чтобы её не жалко было гонять на потоке задач, но при этом достаточно умной для реальной работы. Сам Google называет её «самой интеллектуальной Flash-моделью» и позиционирует под три сценария: длинная разработка софта, автономные агенты и многошаговые корпоративные рассуждения.

Одновременно вышел отдельный вариант — Gemini 3.8 Flash Cyber, заточенный под поиск уязвимостей в коде. Он раздаётся не всем, а доверенным тестировщикам через программу Fairwind. По данным команды безопасности Chrome, вариант Cyber выдаёт в 2,6 раза больше корректных патчей, чем ведущие коммерческие конкуренты. Обычному пользователю он недоступен, так что дальше речь только про базовую 3.8 Flash.

Что выросло по сравнению с 3.7 Flash

По независимому индексу Artificial Analysis модель набирает 59 баллов в режиме высокого рассуждения — на 3 балла больше, чем Gemini 3.7 Flash. Это уровень, на котором Flash впервые встала вровень с флагманами вроде GPT-5.6 Sol и Grok 4.6. Для модели, которую продают как дешёвую и быструю, это заметный сдвиг.

ПараметрGemini 3.7 FlashGemini 3.8 Flash
Индекс Artificial Analysis5659
Контекст1 млн токенов1 млн токенов
Токенов на задачу (среднее)~37 тыс.~48 тыс.
Время на сложную задачу2,2 минуты2,5 минуты

Обратите внимание на две нижние строки — они объясняют, откуда взялся прирост. Модель стала тратить примерно на 30% больше выходных токенов и работать чуть дольше. Google прямо пишет, что 3.8 Flash «работает усерднее»: выполняет дополнительные шаги рассуждения и итеративно вызывает инструменты. То есть часть интеллекта здесь куплена за счёт вычислений, а не только за счёт архитектуры.

Из конкретных цифр: 54,9% на HLE-Verified и результат на DeepSWE v1.1 выше, чем у более крупных фронтир-моделей. Сильнее всего модель прибавила именно на агентных бенчмарках — на банковском 𝜏³-Banking рост составил 12 баллов. Контекстное окно осталось прежним — 1 миллион токенов, вход мультимодальный: текст, изображения, видео и речь, выход — текст.

Сколько стоит

Google повторил трюк трёхнедельной давности: стартовая цена такая же, как была у 3.7 Flash на запуске — 0,75 доллара за миллион входных токенов и 3,75 доллара за миллион выходных. Это промоцена, она действует до 31 декабря. Стандартный тариф вдвое выше: 1,5 и 7,5 доллара соответственно.

Здесь есть подвох, который легко упустить. Раз модель тратит на 30% больше выходных токенов на ту же задачу, реальный счёт растёт быстрее, чем кажется по прайсу. По расчёту Artificial Analysis стоимость одной задачи выходит около 0,58 доллара на высоком рассуждении, 0,41 на среднем и 0,24 на низком. Если задача простая, переключение режима рассуждения экономит больше, чем выбор модели. Как вообще устроен счёт за запрос, мы разбирали в статье «Токены и кредиты».

Как попробовать из России

Официально Gemini 3.8 Flash уже доступна: в приложении Gemini для подписчиков Google AI Pro и Ultra, в режиме AI Mode, в Gemini для Google Таблиц, а для разработчиков — в Google Antigravity, AI Studio и Gemini API. Проблема в том, что все эти двери для российского пользователя закрыты дважды: Google не пускает российские IP в Gemini и AI Studio, а оплатить подписку AI Pro российской картой нельзя.

Честно про Умку: конкретно Gemini 3.8 Flash в каталоге Умки пока нет — модель вышла вчера, и на подключение новинок к агрегаторам обычно уходит от нескольких дней. Из линейки Gemini у нас сейчас работают Gemini 3.1 Pro, Gemini 3 Pro и Gemini 2.5 Flash — на русском, за рубли, без VPN и зарубежных карт. Если задача не требует именно последней Flash, разница для повседневной работы будет незаметной: 3.1 Pro по качеству ответов выше любой Flash-модели, а 2.5 Flash закрывает быстрые массовые задачи. Как выбрать между семействами — в разборе «Claude, GPT или Gemini».

Ещё один вариант — просто подождать. Умка работает как агрегатор поверх общего API, и новые модели появляются в каталоге по мере того, как их открывают провайдеры. Как устроена эта схема, объясняли в материале «Агрегатор нейросетей».

Кому вообще нужна эта новость

Если вы пишете тексты, переводите, делаете саммари писем — прирост в 3 балла индекса вы не заметите. Разница между 3.7 и 3.8 Flash проявляется там, где модель должна сама пройти десять шагов: разобрать репозиторий, вызвать несколько инструментов подряд, довести до конца многоступенчатую задачу. Это сценарии разработчиков и тех, кто строит агентов.

Отдельно стоит держать в голове дату отсечки знаний: по части доменов она у 3.8 Flash — март 2026, по остальным январь 2025. То есть про события лета 2026 модель без веб-поиска не знает ничего, и на вопросы «что нового вышло» отвечать ей не стоит.

Вывод

Gemini 3.8 Flash — не революция, а очередной шаг в очень быстром цикле обновлений: Google выкатывает Flash-модели каждые три-четыре недели и держит промоцену, чтобы не отдавать рынок дешёвого инференса. Для пользователя из России практический вывод простой: новинка недоступна напрямую, но и гнаться за ней необязательно — предыдущие Gemini закрывают почти все бытовые и рабочие задачи, и они уже работают за рубли. Если вы только начинаете, начните с гида «Нейросети на русском».

Источники: Artificial Analysis, 9to5Google.

Gemini уже работает за рубли

Gemini 3.1 Pro, Gemini 3 Pro и 2.5 Flash — в одном чате с Claude, GPT и DeepSeek. Без VPN и зарубежных карт.

Открыть Умку → Посмотреть цены