← Блог Новости

DeepSeek V4.1 Flash: что умеет новая модель

· · 5 минут чтения
DeepSeek V4.1 Flash: кит рядом с окном чата, который видит изображения

Коротко. 10 сентября 2026 года DeepSeek выпустила V4.1 Flash — первую и самую младшую модель нового поколения V4.1. Главная новость не в том, что вышла очередная «быстрая» версия, а в том, что младшая модель, по данным компании, обходит собственный флагман V4 Pro. Вдобавок она нативно понимает изображения, стоит в разы дешевле и уже доступна в чате, приложениях, API и в виде открытых весов. Ниже — что изменилось, где цифры производителя стоит перепроверить и как попробовать модель из России.

Что именно выпустила DeepSeek

V4.1 Flash — модель со смесью экспертов на 552 млрд параметров. На каждый шаг работает лишь малая часть: 8 млрд параметров, когда модель читает запрос, и 16 млрд, когда пишет ответ. Для этого DeepSeek перешла на новую схему «кодировщик — декодировщик», и в этом главный инженерный сдвиг поколения: чтение длинного контекста и генерация текста теперь обходятся по-разному, а не одинаково дорого.

Второе изменение — зрение. Картинки и текст модель училась понимать вместе с самого начала обучения, а не через отдельный модуль, пристёгнутый сбоку. В линейке V4 зрение было только в экспериментальной версии Flash, теперь это штатная возможность.

Третье — экономия памяти. Кэш диалога хранится в четырёхбитном формате и занимает около 890 байт на токен — примерно четверть от того, что требовал V4 Flash. Пользователю это заметно косвенно: длинные переписки и толстые документы дешевле обрабатывать, а значит, провайдерам проще держать их без ограничений. Подробности архитектуры DeepSeek опубликовала в официальном анонсе.

Насколько она сильная на самом деле

По заявлению компании, в тесте Terminal-Bench 2.1, где модель выполняет задачи в командной строке, V4.1 Flash набрала 90,6 балла — чуть больше, чем Claude Opus 5 (89,1) и GPT-5.6 Sol (88,8). В тесте DeepSWE v1.1 на исправление реального кода она решила 74,2% задач. Сама DeepSeek подчёркивает, что по качеству, цене и скорости модель опережает V4 Pro.

К этим цифрам стоит относиться трезво. Разница в полтора балла с Opus 5 — в пределах погрешности, а тесты по программированию плохо предсказывают, как модель напишет письмо, объяснит сложную тему или справится с русским текстом. Честная формулировка такая: на задачах с кодом и командной строкой новая DeepSeek играет в одной лиге с флагманами, а в остальном её нужно проверять на своих запросах.

Показательно и другое решение компании: с 14 сентября запросы к V4 Pro через API DeepSeek будут обслуживаться моделью V4.1 Flash по её тарифу — до выхода V4.1 Pro. Производитель фактически признаёт, что младшая новая модель лучше старшей старой. Чем отличались Pro и Flash прошлого поколения, мы разбирали в статье «DeepSeek V4: что умеют Pro и Flash».

Почему это важно не только разработчикам

В API DeepSeek V4.1 Flash стоит в непиковые часы 0,15 доллара за миллион входных токенов и 0,60 доллара за миллион выходных, в пиковые будние часы — вдвое дороже. Это примерно на 70% дешевле, чем выходные токены V4 Pro. Для обычного пользователя такая цена означает простую вещь: модель уровня флагмана становится массовой, и сервисы, которые её подключают, могут не экономить на длине ответов и контексте.

Открытые веса под лицензией MIT — отдельный плюс. Модель можно скачать и запустить у себя, дообучить под задачу или встроить в продукт без согласования с DeepSeek. Правда, 552 млрд параметров — это серверное железо, а не домашняя видеокарта.

Как попробовать DeepSeek V4.1 Flash из России

Вариантов три. Первый — официальный чат и приложения DeepSeek: модель уже там, сайт обычно открывается из России, но у бесплатного доступа есть очереди и лимиты. Где они проходят, подробно описано в материале «Дипсик нейросеть бесплатно: что доступно без оплаты».

Второй — API. Технически это самый гибкий путь, но оплатить его российской картой не получится.

Третий — Умка. DeepSeek V4.1 Flash уже есть в каталоге, включая отправку картинок, и работает без VPN и зарубежной карты. Модель открывается после пополнения: стартовый пакет — 290 ₽ за 725 токенов, дальше токен дешевеет вплоть до 3900 ₽ за 11 700 токенов. Для ориентира: умный ответ в Умке обходится примерно в 33 токена, быстрый — в 1 токен, так что стартового пакета хватит примерно на два десятка развёрнутых ответов сильных моделей. Точная цена конкретного запроса видна до отправки. Бесплатно сразу после регистрации открыта предыдущая модель DeepSeek — на ней можно сравнить поколения.

Проверьте V4.1 Flash на своей задаче

Задайте один и тот же вопрос DeepSeek V4.1 Flash, Claude и GPT в одном окне и сравните ответы. Оплата рублями, подписки нет.

Открыть Умку →

Вывод

V4.1 Flash — сильный ход DeepSeek: младшая модель нового поколения догнала флагманов на задачах с кодом, научилась видеть изображения и подешевела. Громкие проценты в тестах стоит проверять на своих задачах, но уже сейчас это одна из лучших моделей по соотношению цены и качества. Если вы выбираете, какую нейросеть взять под работу, пригодится наш разбор «Какую нейросеть выбрать».

Частые вопросы

Чем DeepSeek V4.1 Flash отличается от V4 Flash?

Это модель нового поколения, а не обновление старой. У неё другая архитектура, она нативно понимает изображения и, по данным DeepSeek, опережает даже флагманский V4 Pro. При этом память на длинный диалог она расходует примерно вчетверо экономнее, чем V4 Flash.

Можно ли пользоваться DeepSeek V4.1 Flash бесплатно?

В официальном веб-чате и приложениях DeepSeek модель доступна без оплаты, с обычными для бесплатного чата очередями и лимитами. Веса выложены под лицензией MIT, так что при наличии мощного железа модель можно запустить у себя.

Есть ли DeepSeek V4.1 Flash в Умке?

Да, модель уже в каталоге, в том числе с отправкой картинок. Она доступна после пополнения баланса: стартовый пакет стоит 290 рублей и даёт 725 токенов. Бесплатно в Умке открыта предыдущая модель DeepSeek.