Google выпустила компактные модели Gemini 3.6 Flash и Flash-Lite для ускорения ИИ
По данным 3DNews, обе оптимизированы под быстрые и экономичные задачи: суммаризация текстов, работа ИИ-агентов, обработка документов.

Google анонсировала две облегчённые модели — Gemini 3.6 Flash и Gemini 3.5 Flash-Lite. По данным 3DNews, обе оптимизированы под быстрые и экономичные задачи: суммаризация текстов, работа ИИ-агентов, обработка документов. Для нищи дайджестов и суммаризаторов это прямое изменение ценовых и скоростных параметров инфраструктуры. Параллельно Search Engine Roundtable сообщает, что Google начала интегрировать Flash-Lite в поисковую выдачу для ускорения AI Overviews.
Две модели — два сценария применения
Gemini 3.6 Flash — доработка версии с I/O 2026 по обратной связи разработчиков. Ключевые параметры:
- Расход выходных токенов снижен на 17% относительно Gemini 3.5 Flash.
- Стоимость: $1,50 за 1 млн входных токенов, $7,50 за 1 млн выходных.
- Программирование: DeepSWE — 49% против 37%, MLE Bench — 63,9% против 49,7%, GDPval-AA — 1421 против 1349 баллов.
- Требует меньше этапов рассуждений и обращений к инструментам при последовательных действиях.
Gemini 3.5 Flash-Lite — другая линейка. Ориентирована на сценарии с высокой пропускной способностью и минимальными задержками: агентный поиск, обработка документов, генерация ответов в реальном времени. Заявлено превосходство над Gemini 3.1 Flash-Lite и Gemini 3 Flash при более низкой стоимости.
Суммаризация и дайджесты: что изменилось на практике
Для суммаризаторов критичны два фактора: стоимость обработки длинных текстов и скорость ответа. Gemini 3.6 Flash даёт снижение затрат на выходных токенах — это линейная экономия при масштабировании на большие объёмы текстов. На 17% меньше токенов на выходе — на 17% ниже счёт при равном количестве запросов.
Gemini 3.5 Flash-Lite ставка — на задержку. Для дайджестов, где важно отдать пользователю сводку быстро, латентность критичнее, чем глубина рассуждений. По данным Search Engine Roundtable, именно Flash-Lite Google выбрала для интеграции в AI Overviews поисковика — сигнал о приоритете скорости над качеством генерации в массовых сценариях.
Побочный анонс и статус доступа
Также анонсирована Gemini 3.5 Flash Cyber — специализированная модель для поиска уязвимостей в коде. На её основе работает CodeMender с несколькими ИИ-агентами. На первом этапе доступ ограничен государственными организациями и доверенными партнёрами.
Доступ к основным моделям: приложение Gemini, Google Antigravity, AI Studio, Android Studio. Команда DeepMind параллельно ведёт подготовку к запуску Gemini 4 — на наиболее масштабном этапе, по заявлению компании.
Вердикт для ниши
Для операторов суммаризаторов и дайджестов: пересмотр параметров инфраструктуры неизбежен. Gemini 3.6 Flash — кандидат на замену текущих Flash-моделей в задачах, где важна экономия токенов при сохранении качества. Gemini 3.5 Flash-Lite — вариант для массовых низколатентных сценариев, где допустима упрощённая генерация. Выбор между ними — вопрос приоритетов: стоимость или скорость. Универсального ответа нет.