Новости ИИЗнаков 8907Время чтения23 мин

Google выпускает Gemini 3.8 Flash для длительных задач программирования и агентов

Gemini 3.8 Flash предлагает более сильные возможности программирования и агентного рассуждения, контекстное окно на 1 млн токенов, настраиваемый уровень усилий и вводные цены API.

Содержание · 13
  1. 1. Google выпускает третье обновление Flash за шесть недель
  2. 2. Более длительные циклы рассуждения — ключевое изменение продукта
  3. 3. Google сообщает о наибольшем приросте в оценках программирования и агентов
  4. 4. Миграция требует большего, чем смена имени модели
  5. 5. Цены изначально не меняются, но в январе удваиваются
  6. 6. Карточка модели сохраняет важные ограничения
  7. Частые вопросы
  8. Когда была выпущена Gemini 3.8 Flash?
  9. Какой идентификатор API у модели Gemini 3.8 Flash?
  10. Поддерживает ли Gemini 3.8 Flash изображения, аудио и видео?
  11. Сколько стоит Gemini 3.8 Flash?
  12. Находится ли Gemini 3.8 Flash Cyber в общей доступности?
  13. Источники

1. Google выпускает третье обновление Flash за шесть недель

2 сентября Google выпустила Gemini 3.8 Flash, позиционируя модель как наиболее производительную систему уровня Flash для разработки ПО, автономных агентов и многошаговой профессиональной работы. Стабильный идентификатор API — gemini-3.8-flash, и модель вышла в общую доступность, а не в качестве предварительной версии.

Релиз следует за Gemini 3.7 Flash, представленной 13 августа, и Gemini 3.6 Flash, выпущенной 21 июля. Таким образом, Gemini 3.8 Flash стала третьим релизом Flash от Google за шесть недель. Google заявляет, что новая модель сохраняет скорость и вводную цену 3.7 Flash, одновременно улучшая способность поддерживать рассуждение и использование инструментов в более длительных задачах.

Gemini 3.8 Flash принимает текст, изображения, аудио, видео и PDF-документы. Её контекстное окно составляет 1 048 576 входных токенов, а максимальный объём вывода — 65 536 токенов. Вывод остаётся только текстовым: модель может анализировать мультимодальные материалы, но не генерирует изображения или аудио.

Модель поддерживает вызов функций, поиск по файлам, выполнение кода, структурированный вывод, URL-контекст, заземление с помощью Google Search и Maps, а также кеширование контекста. Использование компьютера поддерживается в предварительной версии. Live API, генерация изображений и генерация аудио не поддерживаются.

Одновременно с релизом универсальной модели Google анонсировала вторую модель — Gemini 3.8 Flash Cyber. По данным компании, обе модели используют одинаковый базовый интеллект, однако версия Cyber обладает более разрешительными возможностями в области кибербезопасности и доступна только проверенным государственным структурам, операторам критической инфраструктуры, сопровождающим ПО и другим доверенным защитникам в рамках программы Fairwind от Google DeepMind.

2. Более длительные циклы рассуждения — ключевое изменение продукта

Определяющее отличие от Gemini 3.7 Flash — не более крупное контекстное окно и не новая модальность вывода. Эти базовые ограничения остались без изменений. Вместо этого Google заявляет, что 3.8 Flash охотнее выполняет дополнительные шаги рассуждения, восстанавливается после препятствий и многократно вызывает инструменты, когда задачу нельзя надёжно завершить за один проход.

Такое поведение предназначено для задач вроде навигации по крупной кодовой базе, диагностики сбоев, редактирования нескольких файлов, тестирования результата и доработки реализации. Google продемонстрировала, как модель в Antigravity создаёт 3D-игру, играет в неё для выявления ошибок и применяет изменения кода в продолжающемся агентном цикле. Среди других демонстраций были приложение Google Maps в стиле DOS, топографический визуализатор на основе данных и инструмент разбора аппаратного обеспечения на Three.js.

Эти демонстрации представляют собой контролируемые примеры, а не независимые тесты продукта. Их значение заключается в рабочем процессе: Gemini 3.8 Flash рассчитана на чередование рассуждения, вызовов инструментов, выполнения, наблюдения и доработки, а не просто на возврат образца кода.

Дополнительная тщательность имеет измеримую цену. Google прямо предупреждает, что 3.8 Flash может потреблять больше токенов, чем 3.7 Flash, особенно при более высоких настройках рассуждения. Разработчики могут выбрать LOW, MEDIUM или HIGH через параметр thinking_level; по умолчанию используется MEDIUM. Модель не принимает уровень MINIMAL, и его запрос вызывает ошибку валидации.

Для чувствительных к задержкам или высоконагруженных приложений Google рекомендует снизить уровень усилий либо продолжать использовать Gemini 3.7 Flash. Поэтому практический выбор зависит от рабочей нагрузки: 3.8 Flash предлагает больше устойчивости в сложных задачах, но 3.7 Flash по-прежнему поддерживается для развёртываний, где предсказуемое потребление токенов важнее максимальной завершённости задач.

3. Google сообщает о наибольшем приросте в оценках программирования и агентов

Опубликованные Google оценки показывают улучшения в нескольких тестах, ориентированных на программирование и инструменты, хотя результаты по-прежнему предоставлены самим поставщиком, а производительность в бенчмарках не доказывает надёжность в конкретной производственной среде.

В Terminal-bench 2.1 Gemini 3.8 Flash набрала 90.8% против 81.6% у Gemini 3.7 Flash. Её результат SWE-Atlas вырос с 48.0% до 51.9%, а SWE-Bench Pro — с 60.4% до 61.6%. В банковской подвыборке τ³-bench, проверяющей агентов при обработке многошаговых взаимодействий, заявленный результат вырос с 30.9% до 38.1%.

Модель также достигла 61.4% в Vals Finance Agent v2, опередив Gemini 3.7 Flash с 59.0% в сравнении Google. В Harvey’s Legal Agent Benchmark соответствующие результаты составили 10.0% и 8.8%.

Для HLE-Verified — экспертного междисциплинарного бенчмарка рассуждений — Google сообщила 54.9% для Gemini 3.8 Flash и 53.6% для 3.7 Flash. В опубликованном сравнении 3.8 Flash незначительно опередила GPT-5.6 Sol с 54.5% и Claude Opus 5 с 54.4%. Небольшие различия такого масштаба не следует считать доказательством того, что одна модель будет стабильно превосходить другую в несвязанных рабочих нагрузках.

Google также заявляет, что Gemini 3.8 Flash лидирует в долгосрочной оценке разработки ПО DeepSWE v1.1, работая при этом с меньшими затратами, чем более крупные модели. В обзоре релиза Ars Technica охарактеризовала улучшения как умеренные во многих общих тестах, но более значительные в оценках программирования. Издание также отметило, что, несмотря на улучшение относительно 3.7 Flash в OSWorld 2.0, новая модель всё ещё заметно уступала Claude Opus в этом бенчмарке использования компьютера.

Эта смешанная картина важна для решений о развёртывании. Наиболее убедительный опубликованный аргумент в пользу обновления касается работы в терминале, агентов для программирования и продолжительного выполнения задач, а не равномерного скачка во всех тестах рассуждения или управления компьютером.

4. Миграция требует большего, чем смена имени модели

Разработчикам, переходящим с Gemini 3.7 Flash или 3.6 Flash, необходимо изменить идентификатор модели на gemini-3.8-flash. Руководство Google по корпоративной миграции также предписывает заменить прежнюю целочисленную настройку thinking_budget на перечисление thinking_level.

Несколько устаревших средств управления генерацией недоступны. Google заявляет, что temperature, top_p и top_k игнорируются серверной частью, тогда как frequency_penalty, presence_penalty и candidate_count вызывают ошибки API. Приложениям, зависящим от этих полей, нужны изменения конфигурации, а не только подстановка нового имени модели.

Вызов функций проверяется строже. Ход с ответом функции должен соответствовать идентификатору, имени и количеству выполнений предшествующего вызова функции. Мультимодальные ресурсы необходимо размещать внутри полезной нагрузки ответа, история чата не может завершаться ходом с ролью модели, а предварительно заполненные ответы модели не поддерживаются.

Эти ограничения могут выявить ошибки интеграции, которые старые развёртывания допускали. Командам, оценивающим обновление, следует тестировать полные агентные трассировки, включая повторы, ответы инструментов, структурированные выводы и восстановление истории разговора, а не сравнивать отдельные промпты.

Задокументированная дата отсечения знаний модели — март 2026 года, хотя Google предупреждает, что охват в некоторых областях всё ещё может напоминать отсечение января 2025 года, связанное с более широким семейством Gemini 3. Для актуальной или быстро меняющейся информации по-прежнему необходимы заземление через поиск или другой уровень извлечения данных.

5. Цены изначально не меняются, но в январе удваиваются

До 31 декабря 2026 года включительно стандартное использование Gemini API стоит $0.75 за миллион входных токенов и $3.75 за миллион выходных токенов, включая токены рассуждения. Это те же вводные ставки, что указаны для Gemini 3.7 Flash.

1 января 2027 года ставки удваиваются до $1.50 за миллион входных токенов и $7.50 за миллион выходных токенов. Плата за кеширование контекста также вырастает с $0.075 до $0.15 за миллион токенов, а хранение кеша — с $0.50 до $1 за миллион токенов в час.

Пакетный и Flex-инференс в течение вводного периода стоят $0.375 за миллион входных токенов и $1.875 за миллион выходных токенов. В январе обе ставки вырастут соответственно до $0.75 и $3.75. Priority-инференс стоит дороже: $1.35 за миллион входных токенов и $6.75 за миллион выходных токенов до декабря включительно.

Цена вывода включает внутренние токены рассуждения, поэтому выбор уровня усилий является частью модели затрат. Задача, задействующая больше шагов рассуждения, может стоить дороже, даже если её итоговый видимый ответ короткий. Поэтому при оценке в производственной среде следует фиксировать общее число оплачиваемых токенов, долю завершённых задач, задержку и количество вызовов инструментов, а не сравнивать только прейскурантные цены.

Разработчики могут получить доступ к Gemini 3.8 Flash через Google AI Studio, Gemini API, Android Studio, Stitch и Antigravity. Предприятия могут использовать её через Gemini Enterprise Agent Platform. Потребителям нужна подписка Google AI Pro или Ultra для доступа к ней в приложении Gemini, AI Mode в Google Search и Gemini в Google Sheets.

6. Карточка модели сохраняет важные ограничения

В карточке модели Google указано, что Gemini 3.8 Flash может галлюцинировать, иногда медленно отвечать, завершать работу по тайм-ауту или потреблять больше токенов, чем ожидается, при более высоких уровнях усилий. Поддержка мультимодального ввода и агентных инструментов не отменяет необходимости проверять сгенерированный код, финансовый анализ, юридическую работу или действия, выполняемые через внешние системы.

Компания сообщает о сопоставимой или улучшенной общей эффективности безопасности контента относительно Gemini 3.7 Flash, хотя автоматизированное тестирование выявило небольшое ухудшение в некоторых неанглоязычных оценках безопасности. Google заявляет, что ручная проверка установила: отмеченные потери преимущественно представляли собой ложноположительные или несущественные случаи.

В рамках Frontier Safety Framework от Google DeepMind компания пришла к выводу, что Gemini 3.8 Flash не добавляет существенных возможностей по сравнению с 3.7 Flash в отслеживаемых фреймворком высокорисковых областях и вряд ли достигнет Tracked или Critical Capability Level. Неограниченная модель сохраняет меры защиты от кибернаступательного применения и неправомерного использования химических, биологических, радиологических и ядерных материалов; более функциональный вариант Cyber распространяется отдельно с ограниченным доступом.

Частые вопросы

Когда была выпущена Gemini 3.8 Flash?

Google выпустила стабильную модель 2 сентября 2026 года, через три недели после Gemini 3.7 Flash.

Какой идентификатор API у модели Gemini 3.8 Flash?

Стабильный идентификатор API — gemini-3.8-flash.

Поддерживает ли Gemini 3.8 Flash изображения, аудио и видео?

Она принимает текст, изображения, аудио, видео и PDF в качестве входных данных, но создаёт только текст.

Сколько стоит Gemini 3.8 Flash?

Стандартная цена API составляет $0.75 за миллион входных токенов и $3.75 за миллион выходных токенов до 31 декабря 2026 года. 1 января 2027 года ставки вырастут до $1.50 и $7.50.

Находится ли Gemini 3.8 Flash Cyber в общей доступности?

Нет. Google ограничивает доступ к варианту Cyber одобренными защитниками через программу Fairwind. Универсальная модель Gemini 3.8 Flash находится в общей доступности.

Источники

Share

Поделиться статьёй