DeepSeek выпустила модель V4.1 Flash и выложила веса в открытый доступ
Теперь модель в чат-боте одновременно обрабатывает изображения, скриншоты и текст в «быстром» режиме.
Результаты модели в собственных тестах компании. Источник: DeepSeek
- V4.1 Flash — более компактная и быстрая версия DeepSeek V4.1. Модель получила обновлённую архитектуру — она одновременно обрабатывает текст и визуальные данные.
- В чат-боте DeepSeek убрали «быстрый» режим и отдельную функцию «распознавания изображений». Все запросы перенаправляются V4.1 Flash, которая может одновременно обрабатывать текст, анализировать изображения, таблицы и скриншоты.
- Режим «глубоко мышления» работает на продвинутой V4.1 и тоже поддерживает распознавание картинок.
- Модель обошла GPT-5.6 Sol и Opus 5 в одном из тестов на работу в терминале, как утверждает компания. В бенчмарках на программирование, агентные задачи и умение находить эксплойты превзошла GLM-5.3.
Источник: DeepSeek
- Веса DeepSeek V4.1 Flash выложили на Hugging Face. У неё 552 млрд параметров, контекст — 1 млн токенов.
- Новая архитектура позволяет снизить затраты на обработку запросов и использовать меньший объём памяти для хранения кэша контекста. При обработке входящих токенов активируется только 8 млрд параметров на каждый токен, а на этапе генерации ответа — 16 млрд на токен. Глобальный кэш контекста занимает в четыре раза меньше места по сравнению с предыдущей DeepSeek-V4 Flash, заявляет компания.
- Работа с моделью в API в непиковые часы стоит $0,15 за 1 млн входных токенов и $0,6 за 1 млн выходных токенов. В пиковые — $0,3 и $1,2 за 1 млн входных и выходных токенов.