DeepSeek выпустила модель V4.1 Flash и выложила веса в открытый доступ

Теперь модель в чат-боте одновременно обрабатывает изображения, скриншоты и текст в «быстром» режиме.

Результаты модели в собственных тестах компании. Источник: DeepSeek
Результаты модели в собственных тестах компании. Источник: DeepSeek
  • V4.1 Flash — более компактная и быстрая версия DeepSeek V4.1. Модель получила обновлённую архитектуру — она одновременно обрабатывает текст и визуальные данные.
  • В чат-боте DeepSeek убрали «быстрый» режим и отдельную функцию «распознавания изображений». Все запросы перенаправляются V4.1 Flash, которая может одновременно обрабатывать текст, анализировать изображения, таблицы и скриншоты.
  • Режим «глубоко мышления» работает на продвинутой V4.1 и тоже поддерживает распознавание картинок.
  • Модель обошла GPT-5.6 Sol и Opus 5 в одном из тестов на работу в терминале, как утверждает компания. В бенчмарках на программирование, агентные задачи и умение находить эксплойты превзошла GLM-5.3.
Источник: DeepSeek
Источник: DeepSeek
  • Веса DeepSeek V4.1 Flash выложили на Hugging Face. У неё 552 млрд параметров, контекст — 1 млн токенов.
  • Новая архитектура позволяет снизить затраты на обработку запросов и использовать меньший объём памяти для хранения кэша контекста. При обработке входящих токенов активируется только 8 млрд параметров на каждый токен, а на этапе генерации ответа — 16 млрд на токен. Глобальный кэш контекста занимает в четыре раза меньше места по сравнению с предыдущей DeepSeek-V4 Flash, заявляет компания.
  • Работа с моделью в API в непиковые часы стоит $0,15 за 1 млн входных токенов и $0,6 за 1 млн выходных токенов. В пиковые — $0,3 и $1,2 за 1 млн входных и выходных токенов.
77
22