AI

Google выпустила Gemini 3.8 Flash

Google выпустила Gemini 3.8 Flash

представила 3.8 Flash — новую модель семейства Flash для длинных задач, программирования и автономных агентов. Это уже третий релиз Flash за шесть недель: предыдущую Gemini 3.7 Flash компания выпустила три недели назад.

Gemini 3.8 Flash уже работает в Gemini API и Google AI Studio, а также в Antigravity, Android Studio и Stitch. Для пользователей с подпиской Google AI Pro и Ultra она появилась в приложении Gemini. Детали в материале Postium.

Что нового в Gemini 3.8 Flash

Google доработала модель для задач, где нужно долго работать без постоянного вмешательства человека: планировать несколько шагов, вызывать инструменты, писать код, проверять результат и исправлять ошибки.

На DeepSWE v1.1, который проверяет работу над длинными задачами по разработке ПО, Gemini 3.8 Flash обошла большинство более крупных frontier-моделей. Google также сообщает о росте результатов на агентских тестах для финансовых и юридических задач. На HLE-Verified модель набрала 54,9%.

Рост связан в том числе с тем, что Google разрешила модели тратить больше вычислений на сложный запрос. Gemini 3.8 Flash может выполнить дополнительные reasoning-шаги и несколько раз обратиться к инструментам, прежде чем закончить задачу. На высоком уровне effort это увеличивает расход thinking- и output-токенов.

Разработчик может снизить effort, если важнее расход токенов. Google также продолжит поддерживать Gemini 3.7 Flash для сценариев, где приоритетом остаётся вычислительная экономия.

Сколько стоит Gemini 3.8 Flash?

До 31 декабря 2026 года стандартный API стоит $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных. Google включает thinking-токены в стоимость output. С 1 января 2027 года цены вырастут до $1,50 и $7,50 соответственно.

Из-за более длинного reasoning стоимость завершённой задачи при этом может оказаться выше, чем у 3.7 Flash: ставка за один токен сейчас та же, но 3.8 Flash способна потратить больше токенов до получения результата. Это зависит от сложности запроса и выбранного уровня effort.

Контекстное окно Gemini 3.8 Flash составляет 1 048 576 токенов, максимальный ответ — 65 536 токенов. Модель принимает текст, изображения, видео, аудио и PDF, а отвечает текстом.

Через API она поддерживает function calling, исполнение кода, File Search, Google Search и Google Maps grounding, URL Context и structured outputs. Computer use пока имеет статус Preview. Для thinking доступны уровни low, medium и high; режим minimal модель не поддерживает.

Почему это важно? Gemini 3.8 Flash меняет экономику Flash-моделей: низкая цена токена теперь не обязательно означает минимальную стоимость всей задачи. Google даёт модели возможность дольше рассуждать и повторно обращаться к инструментам, если это повышает шанс закончить сложную работу без вмешательства пользователя.

Для разработчиков появляется выбор между расходами и автономностью. Можно ограничить effort для дешёвых массовых запросов, оставить 3.7 Flash для задач с жёстким бюджетом или дать 3.8 Flash больше вычислений для длинного кодинга и агентских сценариев.

Итог: Gemini 3.8 Flash сохраняет низкую цену за токен семейства Flash, но может тратить больше вычислений на одну задачу, чтобы самостоятельно пройти длинную цепочку действий, вызовов инструментов и исправлений.

Источник

Добавить комментарий

Кнопка «Наверх»