DeepSeek представила ИИ-модель v4.1 Flash — самую компактную и быструю модель компании

Новая нейросеть нативно поддерживает мультимодальный ввод.

DeepSeek представила ИИ-модель v4.1 Flash — самую компактную и быструю модель компании

DeepSeek представила новую облегчённую ИИ-модель — v4.1 Flash. Нейросеть имеет обновлённую архитектуру с поддержкой мультимодальности и облегчённым KV-кэшем.

Одна из главных особенностей v4.1 Flash: система Causal Encoder-Decoder, которая задействует всего 8 млрд параметров на вход и 16 млрд — на выход. Это, как сообщают разработчики, делает нейросеть заметно оперативнее — запросы обрабатываются быстрее и затрачивают меньше токенов.

Новая технология компрессии позволила сжать KV-кэш до 890 байт на токен. Благодаря этому модель занимает на SSD в восемь раз меньше места по сравнению с предыдущей нейросетью v4.0 Pro. Нативно поддерживается мультимодальность.

Также инженеры модели добавили в v4.1 Flash возможность регулировать прилагаемые для обработки запроса усилия — эта функция уже доступна в актуальных ИИ-моделях от OpenAI и Anthropic.

В приведённых компанией бенчмарках v4.1 Flash превзошла по производительности V4-Pro. Она показала более впечатляющие результаты в DeepSWE v1.1, ExploitGym и во всех версиях Terminal-Bench.

В большинстве тестов модель уступает нейросетям конкурентов вроде GPT 5.6-Sol и Claude Opus 5, но разница зачастую составляет не более 10–15%.

v4.1 Flash уже доступна через API DeepSeek. Стоимость в пиковые часы составляет 0,3 доллара (~25 рублей) на вход и 1,2 доллара (~100 рублей) — на выход. В периоды пониженной загрузки стоимость снижается на 50%.