Google представила Gemini 3.8 Flash — новую модель семейства Flash для длинных задач, программирования и автономных агентов. Это уже третий релиз Flash за шесть недель: предыдущую Gemini 3.7 Flash компания выпустила три недели назад.
Gemini 3.8 Flash уже работает в Gemini API и Google AI Studio, а также в Antigravity, Android Studio и Stitch. Для пользователей с подпиской Google AI Pro и Ultra она появилась в приложении Gemini. Детали в материале Postium.
Читайте также: 5 лучших нейросетей для работы
Что умеет нейросеть Gemini 3.8 Flash
Google доработала модель для задач, где нужно долго работать без постоянного вмешательства человека: планировать несколько шагов, вызывать инструменты, писать код, проверять результат и исправлять ошибки.
На DeepSWE v1.1, который проверяет работу над длинными задачами по разработке ПО, Gemini 3.8 Flash обошла большинство более крупных frontier-моделей, в том числе Claude Sonnet 5 и GPT-5.6. Google также сообщает о росте результатов на агентских тестах для финансовых и юридических задач. На HLE-Verified модель набрала 54,9%.

Рост связан в том числе с тем, что Google разрешила модели тратить больше вычислений на сложный запрос. Gemini 3.8 Flash может выполнить дополнительные reasoning-шаги и несколько раз обратиться к инструментам, прежде чем закончить задачу. На высоком уровне effort это увеличивает расход thinking- и output-токенов.
Разработчик может снизить effort, если важнее расход токенов. Google также продолжит поддерживать Gemini 3.7 Flash для сценариев, где приоритетом остаётся вычислительная экономия.
Сколько стоит Gemini 3.8 Flash?
До 31 декабря 2026 года стандартный API стоит $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. Google включает thinking-токены в стоимость output. С 1 января 2027 года цены вырастут до $1,50 и $7,50 соответственно.
Из-за более длинного reasoning стоимость завершённой задачи при этом может оказаться выше, чем у 3.7 Flash: ставка за один токен сейчас та же, но 3.8 Flash способна потратить больше токенов до получения результата. Это зависит от сложности запроса и выбранного уровня effort.
Контекстное окно Gemini 3.8 Flash составляет 1 048 576 токенов, максимальный ответ — 65 536 токенов. Модель принимает текст, изображения, видео, аудио и PDF, а отвечает текстом.
Почему это важно? Gemini 3.8 Flash меняет экономику Flash-моделей: низкая цена токена теперь не обязательно означает минимальную стоимость всей задачи. Google даёт модели возможность дольше рассуждать и повторно обращаться к инструментам, если это повышает шанс закончить сложную работу без вмешательства пользователя.
Для разработчиков появляется выбор между расходами и автономностью. Можно ограничить effort для дешёвых массовых запросов, оставить 3.7 Flash для задач с жёстким бюджетом или дать 3.8 Flash больше вычислений для длинного кодинга и агентских сценариев.
Ранее Google начала открывать доступ к Pics — ИИ-редактору изображений на базе Nano Banana, который умеет генерировать изображения и редактировать отдельные объекты, области и текст, также компания выпустила Gemini Omni 1.1 Flash — модель для генерации и редактирования видео через.
Итог: Gemini 3.8 Flash сохраняет низкую цену за токен семейства Flash, но может тратить больше вычислений на одну задачу, чтобы самостоятельно пройти длинную цепочку действий, вызовов инструментов и исправлений.