Информация о модели
Описание
Gemini 3.8 Flash — следующая итерация в семействе моделей Gemini 3, построенная на основе Gemini 3.7 Flash. Модель приносит прирост производительности в задачах разработки ПО и агентных рабочих процессах, связанных со знаниями. Как и предшественница, она поддерживает настраиваемые уровни «усилия» для управления балансом качества, стоимости и задержки.
Зависимости модели
Gemini 3.8 Flash базируется на Gemini 3.7 Flash.
Входные данные
Текстовые строки (вопросы, промпты, документы для суммаризации), изображения, аудио- и видеофайлы, с окном контекста до 1 млн токенов.
Выходные данные
Текст, с ограничением вывода в 64 тыс. токенов.
Архитектура
Gemini 3.8 Flash основана на архитектуре Gemini 3.7 Flash. Подробности об архитектуре можно найти в карточке модели Gemini 3.7 Flash.
Данные модели
Обучающий датасет
Gemini 3.8 Flash базируется на Gemini 3.7 Flash. Подробности об обучающем датасете — в карточке модели Gemini 3.7 Flash.
Обработка обучающих данных
Подробности об обработке обучающих данных для Gemini 3.8 Flash — в карточке модели Gemini 3.7 Flash.
Реализация и устойчивое развитие
Аппаратное обеспечение
Gemini 3.8 Flash базируется на Gemini 3.7 Flash. Подробности об используемом оборудовании и приверженности устойчивой эксплуатации — в карточке модели Gemini 3.7 Flash.
Программное обеспечение
Gemini 3.8 Flash базируется на Gemini 3.7 Flash. Подробности о программном стеке — в карточке модели Gemini 3.7 Flash.
Распространение
Gemini 3.8 Flash доступна через следующие каналы:
- приложение Gemini
- Gemini Enterprise Agent Platform
- Google AI Studio
- Gemini API
- Google AI Mode
- Google Antigravity
Модели доступны сторонним провайдерам через API и распространяются на соответствующих условиях использования. Для работы с моделью не требуется специальное оборудование или ПО. Для AI Studio и Gemini API применяются дополнительные условия использования Gemini API; для Gemini Enterprise Agent Platform — условия использования Google Cloud Platform. Подробнее — в инструкциях по Gemini Model API и быстром старте Gemini API.
Оценка
Подход
Gemini 3.8 Flash протестирована на широком наборе бенчмарков, включая написание кода, работу со знаниями, мультимодальные возможности, длинный контекст, взаимодействие с компьютером и научные рассуждения. Дополнительные бенчмарки и методология оценки доступны по адресу: deepmind.com/models/evals-methodology/gemini-3-8-flash.
Результаты
Результаты по состоянию на сентябрь 2026 года:
Подробности о методологии оценки: deepmind.com/models/evals-methodology/gemini-3-8-flash
Назначение и ограничения
Преимущества и предполагаемое использование
Gemini 3.8 Flash подходит для пользователей, разработчиков и предприятий, ориентирована на экономически эффективное масштабирование универсальных production-ready агентов. Среди сценариев использования: разработка ПО, агентные задачи и комплексные рабочие процессы со знаниями.
Известные ограничения
Gemini 3.8 Flash может проявлять общие ограничения фундаментальных моделей, такие как галлюцинации. Разработчики продолжают работу над устойчивостью к джейлбрейкам и недавно усилили меры защиты в рамках Frontier Safety. Возможны эпизодические задержки или таймауты. В отдельных случаях модель может использовать больше токенов для максимизации качества, особенно на высоких уровнях «усилия».
Дата отсечения знаний для Gemini 3.8 Flash — март 2026 года: пользователи могут получить актуальную информацию в одних областях, в то время как в других знания модели могут быть ограничены январём 2025 года (в соответствии с семейством моделей Gemini 3). Подробнее об известных ограничениях — в карточке модели Gemini 3.7 Flash.
Допустимое использование
Подробности о допустимом использовании — в карточке модели Gemini 3.7 Flash.
Этика и безопасность контента
Подход к оценке
Подробности о подходе к оценке для Gemini 3.8 Flash — в карточке модели Gemini 3.7 Flash.
Политики безопасности
Подробности о политиках безопасности для Gemini 3.8 Flash — в карточке модели Gemini 3.7 Flash.
Результаты оценки на этапе обучения и разработки
Ниже приведены результаты некоторых внутренних оценок безопасности, проведённых на этапе разработки. Это результаты автоматизированных оценок, а не ручного тестирования или red teaming. Баллы представлены в виде абсолютного процентного увеличения или уменьшения производительности по сравнению с указанной моделью.
В целом Gemini 3.8 Flash показывает результаты, схожие с Gemini 3.7 Flash, как по безопасности, так и по тону, с низким уровнем необоснованных отказов. Производительность безопасности для языков, отличных от английского, немного снизилась по сравнению с 3.7 Flash.
| Оценка | Описание | Gemini 3.8 Flash vs. Gemini 3.7 Flash |
|---|---|---|
| Безопасность текст-в-текст | Автоматизированная оценка безопасности контента по политикам безопасности | -0,4 п.п. Меньше — лучше |
| Многоязычная безопасность | Автоматизированная оценка политик безопасности на нескольких языках | +5,4 п.п. Меньше — лучше |
| Безопасность изображение-в-текст | Автоматизированная оценка безопасности контента по политикам безопасности | 0,0 п.п. Меньше — лучше |
| Тон1 | Автоматизированная оценка объективности тона ответов модели | +0,2 п.п. Больше — лучше |
| Необоснованные отказы | Автоматизированная оценка способности модели отвечать на пограничные запросы, оставаясь безопасной | +1,1 п.п. Меньше — лучше |
1 Для тона и следования инструкциям положительный процент означает улучшение тона модели в чувствительных темах и способности следовать инструкциям, оставаясь безопасной, по сравнению с Gemini 3 Flash. Улучшения отмечены зелёным, регрессии — красным.
Внутренние оценки постоянно совершенствуются, включая уточнение автоматизированных проверок для снижения числа ложноположительных и ложноотрицательных срабатываний, а также обновление наборов запросов для обеспечения баланса и высокого качества результатов. Приведённые результаты рассчитаны с учётом улучшенных методик оценки и потому не могут напрямую сравниваться с результатами из предыдущих карточек моделей Gemini.
Ожидается некоторый разброс результатов автоматизированных оценок безопасности, поэтому помеченный контент проверяется вручную на предмет вопиющих или опасных материалов. Ручная проверка подтвердила, что потери в баллах в подавляющем большинстве случаев были либо а) ложноположительными срабатываниями, либо б) не носили вопиющего характера.
Результаты ручного red teaming
Ручное red teaming проводят специализированные команды, не входящие в команду разработки модели. Основные выводы передаются команде разработчиков. По части оценок безопасности детей Gemini 3.8 Flash прошла необходимые пороги запуска, разработанные экспертными командами для защиты детей в сети в соответствии с обязательствами Google по безопасности детей во всех моделях и продуктах компании. В части политик безопасности контента в целом, включая безопасность детей, зафиксирована схожая или улучшенная производительность по сравнению с Gemini 3.7 Flash. Кроме того, red teaming охватил потенциальные проблемы за пределами строгих политик компании, сравнил результаты с Gemini 3.1 Pro и не выявил серьёзных поводов для беспокойства.
Оценка Frontier Safety
Gemini 3.8 Flash входит в серию моделей Gemini 3. Gemini 3.7 Flash была оценена в соответствии с последней версией Frontier Safety Framework (апрель 2026), и не достигла ни одного из отслеживаемых или критических уровней возможностей (T/CCL). Оценки показывают, что у Gemini 3.8 Flash нет значимых новых возможностей или существенного прироста производительности в областях, обозначенных в Frontier Safety Framework, по сравнению с Gemini 3.7 Flash. Поэтому, основываясь на результатах Gemini 3.7 Flash, разработчики уверены, что Gemini 3.8 Flash также вряд ли достигнет каких-либо T/CCL.
Подробнее об оценке Frontier Safety — в карточке модели Gemini 3.7 Flash.