Google расширяет линейку Gemini 3.6: скорость, доступность и 1 млн токенов контекста

Google продолжает расширять свою экосистему искусственного интеллекта, делая ставку не только на мощь, но и на доступность. Представлены две облегчённые версии — Gemini 3.6 Flash и Gemini 3.6 Flash-Lite. Они созданы для задач, где скорость и экономия важнее, чем максимальная глубина рассуждений, и уже доступны разработчикам по всему миру. Модели уже доступны - здесь

Google расширяет линейку Gemini 3.6: скорость, доступность и 1 млн токенов контекста

Gemini 3.6 Flash: баланс скорости и интеллекта

Gemini 3.6 Flash приходит на смену предыдущей версии 3.1 Flash. Новая модель стала заметно быстрее, при этом сохранив высокое качество ответов для повседневных задач. Доступна- здесь

Ключевые улучшения:

  • Скорость. Время ответа сократилось примерно на 25% по сравнению с 3.1 Flash. Модель идеальна для чат-приложений, голосовых ассистентов и систем, где важна низкая задержка.
  • Качество. На бенчмарках MMLU-Pro и MATH Flash 3.6 показывает результаты, приближающиеся к Gemini 3.6 Pro, но без тяжёлых вычислительных затрат.
  • Мультимодальность. Как и все модели семейства Gemini, Flash 3.6 понимает текст, изображения, аудио и видео, что делает её универсальным инструментом.

Цена осталась на уровне предыдущего Flash — 1,50 на выходе, что в разы дешевле топовых моделей.

Gemini 3.6 Flash-Lite: максимальная экономия

Модели доступны- здесь. Если Flash — это «золотая середина», то Flash-Lite — это решение для массовых задач, где цена имеет решающее значение.

Особенности Flash-Lite:

  • · Самая низкая цена в линейке. Вход — 0,70. Это в 2 раза дешевле, чем у обычного Flash, и почти в 20 раз дешевле, чем у Pro-версии.
  • · Контекстное окно 1 млн токенов. Несмотря на лёгкость, модель сохраняет возможность работать с большими объёмами данных — можно загружать целые книги или многотысячные кодовые базы.
  • · Достаточное качество для большинства сценариев. Flash-Lite отлично справляется с извлечением информации, суммаризацией, категоризацией и базовым кодингом. Для глубоких рассуждений или сложной математики лучше выбрать Flash или Pro.

Кому и зачем?

Выбор между моделями сводится к балансу «цена — качество — скорость»:

Модель Цена (вход/выход). Для кого

  • Gemini 3.6 Pro $5 / $20 Исследования, сложная аналитика, агентные системы
  • Gemini 3.6 Flash $0,15 / $1,50 Чат-боты, поддержка, быстрые прототипы
  • Gemini 3.6 Flash-Lite $0,07 / $0,70 Массовая обработка данных, RAG-системы, извлечение сущностей

Flash-Lite становится идеальным выбором для компаний, которым нужно перерабатывать миллионы документов: анализ отзывов, обработка счетов, модерация контента. При этом точность остаётся высокой, а экономия бюджета — очевидной.

Доступность

Обе модели уже доступны - здесь

  • Google AI Studio — для быстрых экспериментов без программирования.
  • Vertex AI — для интеграции в корпоративные приложения через API.
  • Gemini API — с поддержкой всех режимов (текст, чат, мультимодальные запросы).

Разработчики могут выбрать нужную версию и начать использовать её в своих проектах прямо сейчас.

Итог

Google продолжает демократизировать доступ к передовому ИИ. Gemini 3.6 Flash и Flash-Lite — это ответ на запрос рынка: не всегда нужен «супер-интеллект», часто важны скорость, цена и предсказуемость. Новая линейка позволяет разработчикам подбирать модель под конкретную задачу, не переплачивая за ненужную мощность.

Попробовать обе модели можно - здесь

2