Google выпустила Gemini 3.8 Flash - третий Flash за шесть недель
Flash — средняя линейка моделей Google . Она уступает старшим версиям Pro по глубине, зато отвечает быстрее и стоит дешевле, и именно на ней у разработчиков держится основная масса агентных сценариев. Обновление Google подаёт как самую способную Flash за всю историю линейки и одновременно открывает отдельную ветку для специалистов по кибербезопасности. Обе модели уже работают, но пускают к ним по-разному.
Третий Flash за шесть недель
Gemini 3.8 Flash вышла 2 сентября, предыдущая 3.7 Flash — тремя неделями раньше. За шесть недель Google обновила быструю линейку трижды, и такой темп сам по себе становится частью новости. Команды, которые переводят продакшен на новую модель, физически не успевают закончить переезд до следующего релиза.
Обе новинки собраны на одной базе и разведены по задачам. Обычная 3.8 Flash идёт в массовые агентные сценарии, версия Cyber — в поиск уязвимостей и починку кода.
Что меряют DeepSWE, HLE и Vals
Названия тестов в анонсе Google говорят мало, поэтому по порядку.
- DeepSWE v1.1 — долгая самостоятельная работа над кодом, когда модель ведёт задачу десятками шагов без человека. У Gemini 3.8 Flash 73,7 % против 65,3 % у прошлой версии, у Claude Opus 5 — 74,0 %, у GPT-5 .6 Sol — 72,7 %.
- Vals Finance Agent v2 — работа финансового аналитика с отчётностью. 61,4 %, лучший результат в таблице Google.
- Harvey's Legal Agent Benchmark — сложные юридические процессы, где засчитывается только полностью закрытая задача. 10,0 % против 6,7 % у Opus 5 и 2,5 % у Sol.
- HLE-Verified — экзаменационные вопросы уровня аспирантуры по естественным, гуманитарным и профессиональным дисциплинам, с перепроверенными ответами. 54,9 %, вплотную к Opus 5 с его 54,4 % и Sol с 54,5 %.
- LABBench2 и BioMysteryBench — исследовательские задачи по биологии и биоинформатике. 86,2 % и 56,5 % на трудной половине, обе строки в таблице лучшие.
Лидерство на юридическом тесте стоит читать вместе с абсолютной цифрой. Десять процентов полностью закрытых дел означают, что юридический процесс целиком не тянет пока ни одна модель, и первое место здесь остаётся первым местом среди не справившихся.
Обратная сторона видна в этой же таблице. На GDPVal-AA v2, где меряют обычную офисную работу со знаниями, Gemini 3.8 Flash набирает 1545 очков против 1824 у Claude Opus 5 и 1710 у GPT-5.6 Sol. На OSWorld-2.0, где агент управляет компьютером как человек, — 59,0 % против 75,4 % у Opus 5. Прирост у новой Flash неровный. Там, где нужно вести узкую отраслевую задачу по шагам, она вырывается вперёд, а на общей работе за компьютером остаётся крепким середняком.
В демонстрациях Google показывает генерацию рабочих игр и приложений по одному промпту, вплоть до трёхмерной головоломки в декорациях замка и эмуляции Google Maps в стилистике DOS.
Три версии Terminal-bench, три картины
Отдельная история с Terminal-bench — тестом, где модель решает задачи прямо в командной строке. На версии 2.1 у Gemini 3.8 Flash 89,4 % против 85,8 % у прошлой версии, и это чуть выше Claude Opus 5 с его 89,1 %.
На версии 4.0, собранной из более общих агентных задач, расклад переворачивается. У Gemini 3.8 Flash 19,1 %, у Opus 5 — 51,8 %, разрыв почти втрое. Противоречия здесь нет, поколения теста несопоставимы между собой и собраны из разных задач. Полезнее другое наблюдение. Процент без номера версии рядом не значит ничего, а разброс между поколениями одного теста бывает кратным. Google, к её чести, публикует обе строки, хотя вторая её не красит.
Gemini 3.8 Flash жжёт токены
Google описывает поведение модели формулировкой «работает усерднее». На сложных задачах Gemini 3.8 Flash делает больше шагов рассуждения и чаще дёргает инструменты, а уровень усилий разработчик задаёт сам — низкий, средний или высокий.
Расплата видна в независимых измерениях. На одном и том же наборе задач модель выдаёт примерно на 70 % больше выходных токенов, чем средняя модель на рынке, и одна задача обходится на 40 % дороже, чем у 3.7 Flash, — при формально одинаковой ставке за токен. Первого ответа приходится ждать около 13 секунд против трёх у медианной модели, зато дальше текст льётся со скоростью порядка 300 токенов в секунду.
Цена уровня усилий видна на кривой стоимости, которую Google публикует для DeepSWE. У Gemini 3.8 Flash там две точки. Прогон в экономном режиме обходится примерно в два доллара за задачу и даёт около 71 %, полный — чуть дороже и выводит на 73,7 %. Последние три процентных пункта стоят примерно пятой части бюджета.
Google прямо советует остаться на 3.7 Flash тем, для кого критична экономия. Вендор, который в день релиза рекомендует не переходить на новинку, встречается нечасто.
Цена удвоится 1 января
До 31 декабря Gemini 3.8 Flash стоит 0,75 доллара за миллион входных токенов и 3,75 доллара за миллион выходных — ровно столько же, сколько просили за 3.7 Flash, а вот с 1 января 2027 года, ставки удваиваются, до 1,5 и 7,5 доллара. Пакетная и гибкая обработка идут вдвое дешевле, приоритетная очередь — в 1,8 раза дороже стандарта.
Для масштаба, ставки конкурентов за миллион токенов на входе и выходе выглядят так:
- Claude Sonnet 5 — 2 и 10 долларов;
- Claude Opus 5 — 5 и 25 долларов;
- GPT-5.6 Terra — 2 и 12 долларов;
- GPT-5.6 Sol — 4 и 20 долларов.
Ставка за токен мало что говорит, пока не переведена в стоимость закрытой задачи. На той же кривой DeepSWE Gemini 3.8 Flash берёт свои 73,7 % примерно за два доллара с задачи, Claude Opus 5 выходит на тот же результат при расходе около двенадцати, Claude Fable 5 тратит порядка тринадцати и остаётся ниже по проценту. Разрыв примерно шестикратный, и живёт он до конца декабря.
Верхний правый угол этой кривой Google подписала словами «most efficient», и Gemini 3.8 Flash стоит там в одиночестве. График честный, но нарисован он вокруг единственного показателя, по которому у Google сейчас лучшая позиция на рынке.
Где Gemini стоит среди флагманов
В сводном индексе интеллекта Gemini 3.8 Flash набирает 59 баллов и делит место с GPT-5.6 Sol и Grok 4.6. Выше идут Claude Opus 5 с 63 баллами и Claude Fable 5.1 с 66. Пара открытых китайских моделей держится на балл выше новинки Google.
Верх таблицы Google этим релизом не забирает и, судя по позиционированию, не пытается. Ставка сделана на другое — держать уровень чужих флагманов при цене средней модели.
Cyber-версия нашла дыру за два часа
Gemini 3.8 Flash Cyber заточена под две операции. Она ищет уязвимость в коде и предлагает рабочую заплатку. На тесте CyberGym, где дыры ищут в программах на C и C++, модель закрывает с первой попытки 86,2 % задач. Прошлая профильная версия 3.5 Flash Cyber брала 77,5 %, универсальные флагманы остались позади — Claude Mythos 5 с 83,8 % и GPT-5.6 Sol с 83,6 %.
Ближайший соперник у Gemini 3.8 Flash Cyber тоже профильный - это GPT-5.5-Cyber от OpenAI с результатом 85,6 %, и разрыв составляет шесть десятых процентного пункта. Звание самой способной модели в кибербезопасности Google удерживает, но запас измеряется долями процента, причём над моделью прошлого поколения. На внутреннем тесте Google по двадцати языкам программирования доля найденных уязвимостей превышает 70 %.
С починкой сложнее. На CWE-Bench модель закрывает уязвимость с первой попытки в 47,2 % случаев против 47,8 % у лучшей frontier-модели — паритет, достигнутый заметно дешевле.
Внутри компании счёт уже практический. Команда безопасности Chrome получила в 2,6 раза больше корректных патчей, чем от крупных коммерческих моделей. Исследователи Google Cloud нашли критическую уязвимость меньше чем за два часа там, где обычно уходят месяцы. Партнёры из отрасли сообщают о приросте полноты поиска на 7,5–9,7 % при цене в 2,3–5,2 раза ниже прежней.
Fairwind пускает не всех
Доступ к Gemini 3.8 Flash Cyber выдают через новую программу Fairwind , и это закрытый контур. Заявки принимают от государственных киберведомств, операторов критической инфраструктуры в здравоохранении, связи, энергетике и финансах, а также от компаний, которые поддерживают базовые программные платформы. Каждого кандидата проверяют на репутацию и историю работы.
Правила участия жёсткие. Модель разрешено применять только в обороне и исследованиях, вход защищают многофакторной аутентификацией, доступ ограничивают внутренними командами безопасности, а использование сотрудниками организация обязана отслеживать и документировать. Перепродавать и передавать доступ нельзя. Участникам открывают связку модели с CodeMender — агентом, который автоматически проверяет и правит найденные уязвимости. Сейчас в программе больше 650 партнёров по всему миру.
Причина закрытости в настройках фильтров. Публичную 3.8 Flash Google наоборот усилила по чувствительным темам, включая наступательные кибероперации и оружейную тематику, а у версии Cyber ограничения ослаблены осознанно — иначе она не смогла бы работать с эксплойтами. За одну неделю это уже третий вендор с такой схемой. Anthropic отдаёт по проверке Mythos, OpenAI придержала Astra, теперь Google открывает Fairwind. Модели верхнего киберуровня перестают быть товаром с полки.
Где включили и кому дали
Обычная Gemini 3.8 Flash уже разошлась по продуктам Google. В среде разработки Antigravity она стоит моделью по умолчанию для управляемых агентов. Через API она доступна в Google AI Studio и Android Studio, работает в генераторе интерфейсов Stitch, в Google Sheets и в корпоративной платформе Gemini Enterprise. Подписчикам планов Google AI Pro и Ultra модель открыли в приложении Gemini и в режиме AI Mode внутри поиска.
Попробовать без оплаты можно в Google AI Studio — там работает бесплатный тариф с лимитами, вход по аккаунту Google. Российскому читателю стоит держать в голове, что официально Gemini здесь не работает. Подписку Pro или Ultra российской картой не оформить, а платный доступ к API остаётся вопросом сторонних посредников со своими наценками и рисками.
Что из этого выжать вебмастеру
Выбор между 3.7 и 3.8 Flash определяется характером задачи, а общий уровень модели тут вторичен. Массовую рутину вроде переписывания описаний товаров или разбора выгрузок дешевле оставить на 3.7 Flash, где ставка та же, а токенов уходит меньше. Тяжёлые многошаговые прогоны, где агент сам чинит ошибки и проверяет результат, разумно перенести на 3.8 Flash и начать с низкого уровня усилий, повышая его только там, где качество действительно проседает.
Для объёмных пакетных задач стоит смотреть на пакетный режим Google с двойной скидкой. И считать не ставку за миллион токенов, а стоимость закрытой задачи целиком, — на этой модели две цифры расходятся сильнее обычного.
Скидка держится до 31 декабря
Главная проверочная точка релиза приходится на 1 января. Пока Gemini 3.8 Flash продаётся по цене прошлого поколения, её расточительность по токенам прощается. Даже с сорокапроцентной надбавкой за задачу она остаётся самой дешёвой моделью своего уровня. После удвоения ставок это перестанет работать автоматически.
Google оставила себе четыре месяца на то, чтобы научить модель тратить меньше или закрепить её в чужих продакшенах так прочно, что переезд обратно окажется дороже подорожания. Второй путь для вендора надёжнее, и темп релизов намекает, что выбран именно он.
Посмотрите в видео, как Gemini 3.8 Flash сочетает встроенное понимание видео с продвинутым программированием, чтобы автономно создать эту 3D-игру, сыграть в неё для поиска ошибок и выполнить изменения кода в плавном агентском цикле в Антигравити.