Google бросает «молниеносный» Gemini 3.8 Flash. Стоит ли он тем, кто живёт на бесплатных облаках?
В блоге Google анонсировали Gemini 3.8 Flash: мульти‑модальная модель с контекстом до 100 К токенов, цена $0.001 за 1 K токенов. По их словам, она быстрее Gemini 1.5 и позиционируется как «Flash»‑вариант.
Для меня, кто собирает AI‑агенты на бесплатных сервисах, важнее реальные затраты, чем рекламный слоган. При лимите 100 К токенов и цене $0.001 за 1 K токенов стоимость запросов действительно низка, но только если запросы укладываются в лимит. На бесплатных уровнях облаков часто встречаются ограничения CPU, памяти и времени выполнения, что может нивелировать заявленную скорость. Без кастомных оптимизаций (сжатие запросов, батчинг) прирост производительности будет трудно измерить.
Скептически отношусь к обещаниям «молниеносного» отклика без учёта полной цепочки: сетевые задержки, ограничения бесплатных планов и накладные расходы. Если в текущих проектах каждый запрос уже стоит несколько центов из‑за этих факторов, Gemini 3.8 Flash может выглядеть привлекательно, но на бесплатных стэках я бы сначала проверил, насколько действительно снижается латентность, а не полагался на маркетинговый слоган.
Источник: blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/