Новый DeepSeek V4.1 Flash: 552 миллиарда параметров по цене чашки кофе
DeepSeek выпустила V4.1 Flash — модель, которая официально превзошла собственный флагман V4 Pro по всем ключевым метрикам и при этом стоит копейки. Компания не стала устраивать шоу. Просто выкатила релиз, срезала цены и объявила, что старая модель уходит на пенсию. DeepSeek V4.1 Flash - здесь
Что внутри: архитектура, которая экономит
V4.1 Flash — это 552 миллиарда параметров в архитектуре MoE (Mixture of Experts) с новым дизайном Causal-Encoder-Decoder. Ключевая фишка — асимметричная активация: при чтении входа работают всего 8 миллиардов параметров, при генерации ответа — 16 миллиардов. Это не «урезанная» модель. Это модель, которая думает только там, где нужно.
Контекстное окно — 1 миллион токенов. Нативная поддержка изображений. Обучена с нуля на 34 триллионах токенов.
Но главное — KV-кэш. Инженеры DeepSeek ужали его так, что постоянное хранилище занимает 1/8 от объёма V4 Flash. Для агентных задач, где кэш — основная статья расходов, это меняет экономику целиком.
Бенчмарки: младшая модель бьёт старшую
DeepSeek V4.1 Flash - здесь
Официальные тесты DeepSeek показывают, что V4.1 Flash обошла V4 Pro практически везде:
DeepSWE v1.1 74,2% 62,7% Разработка ПО — рост на 19,8 п.п. от V4 Flash
Terminal-Bench 2.1 90,6% 82,7% Кодинг в терминале
Codeforces 3471 3348 Рейтинг спортивного программирования
GPQA Diamond 90,9% 92,4% Научные рассуждения — здесь Pro чуть впереди
На DeepSWE v1.1 модель набрала 74,2% — это выше, чем у Claude Opus 5 (74,0%). На CyberGym — 88,1%.
Цены: от 2 копеек за миллион токенов
Новый прайс вступил в силу 10 сентября, в полдень по Пекину:
Свободное время (off-peak):
· Кэш-хит на входе: 0,02 юаня (~0,003 доллара) за 1М токенов
· Кэш-мисс на входе: 1 юань
· Выход: 4 юаня (~0,56 доллара)
Пиковые часы:
· Цены удваиваются: 0,04 / 2 / 8 юаней соответственно
В долларах по API: $0,15 вход / $0,60 выход за миллион токенов. Для сравнения: Claude Fable 5 стоит $10 за входной миллион. Разница — в 46 раз.
Что это значит на практике
Для разработчиков. Агентные задачи, где раньше каждый вызов API обходился в доллары, теперь стоят центы. Рефакторинг, код-ревью, автотесты — всё то, что жрёт токены литрами, становится доступным без бюджета.
Для рынка. DeepSeek продолжает давить на цены. Компания закрыла раунд на $7+ млрд и может позволить себе демпинговать, пока конкуренты считают юнит-экономику. OpenAI и Anthropic уже снижают цены — но не так радикально.
Для V4 Pro. С 14 сентября запросы к V4 Pro будут автоматически перенаправляться на V4.1 Flash по ценам Flash. Модель не отключают — её просто растворяют в новой.
Вывод Vectra
DeepSeek снова сделала то, за что её любят и ненавидят: выпустила модель, которая стоит как чашка кофе, работает как флагман и хоронит предыдущее поколение. Не потому, что так задумано. А потому, что альтернатив у конкурентов просто нет.
DeepSeek V4.1 Flash - здесь