Младшая по названию модель обогнала флагман
DeepSeek выпустила V4.1 Flash — и официально объявила, что отправляет на покой собственный флагман V4 Pro: с 14 сентября все его запросы переведены на Flash. Быстрее, дешевле и по большинству тестов сильнее — разбираем, что стоит за этим редким случаем, когда «младшая» модель заменяет старшую.
По данным DeepSeek, результат V4.1 Flash на этом тесте совпадает с Claude Opus 5 — моделью, которая на сайте Strelka AI не представлена.
V4 Pro уходит на покой
DeepSeek прямо заявила: «мы отправляем V4 Pro на покой». С 14 сентября 2026 года все запросы, которые раньше шли в V4 Pro, автоматически перенаправляются на V4.1 Flash — и тарифицируются уже по её, более низкой ставке. Причина не в возрасте модели, а в том, что новая архитектура V4.1 Flash обходит V4 Pro по качеству, скорости и стоимости одновременно — по формулировке самого разработчика.
Одновременно с этим сняты с производства и первая V4 Flash, и экспериментальная модель с распознаванием изображений, выпущенная в августе 2026 года — обе их задачи теперь тоже покрывает V4.1 Flash. На сайте Strelka AI страница DeepSeek V4 Pro остаётся — для истории и прямого сравнения, но актуальная модель линейки теперь эта.
Что изменилось по сравнению с V4 Pro
Дело не только в перераспределении запросов — у модели новая архитектура и способности, которых у V4 Pro не было вовсе.
Зрение прямо в модели
V4 Pro понимала только текст. V4.1 Flash принимает изображения произвольного разрешения без отдельной предобработки — собственный визуальный энкодер обучен с нуля.
Причинная архитектура энкодер-декодер
Новая для линейки схема — 20 слоёв энкодера и 20 декодера — вместо чисто декодерной архитектуры прежних версий.
Отдельный блок Engram
По техническому отчёту, помимо основной MoE-сети на 552 млрд параметров модель использует дополнительный блок Engram примерно на 196 млрд — суммарно архитектура заметно крупнее, чем показывает базовая цифра.
В разы дешевле и быстрее
Именно поэтому DeepSeek перевела на неё все запросы V4 Pro — точные тарифы смотрите в разделе тарифов, они не влияют на подписку Strelka AI.
За счёт чего «младшая» модель обогнала флагман
Ускорение не абстрактное — DeepSeek называет два конкретных технических приёма.
Compressed Sparse Attention 2 вместе со сжатием кеша в 4-битном формате снижают объём памяти на хранение контекста примерно до четверти от того, что требовала V4 Flash — и это отражается на цене и скорости ответа.
Вместо генерации по одному токену модель заранее предсказывает несколько следующих и проверяет их пакетом. Если предсказание подтверждается, ответ формируется за меньшее число шагов без потери качества.
Цифры DeepSeek — и что с ними стоит учитывать
Модель заняла первое место среди открытых моделей в независимом индексе Vals.ai — но большинство цифр ниже пока это заявления самого разработчика.
Все показатели выше опубликованы самой DeepSeek. Независимое подтверждение есть только для одного пункта: модель заняла первое место среди открытых моделей в стороннем рейтинге Vals.ai — это уже не самоотчёт. Для остальных тестов сторонняя перепроверка на момент публикации не найдена.
Terminal-Bench 3.0 — заметно более трудный тест, чем версия 2.1, и результат 30,0 на нём не стоит сравнивать напрямую с 90,6 на старой версии: это разные шкалы сложности. Мы указываем оба, чтобы не создавать ложного впечатления регресса.
Кому подойдёт DeepSeek V4.1 Flash
Код и инженерные задачи
Лучший результат на DeepSWE v1.1 в линейке — заметный рост относительно V4 Pro.
Разбор картинок и схем
Новая способность: можно приложить фото или скриншот прямо к запросу.
Кому нужны открытые веса
MIT-лицензия позволяет использовать модель в коммерческих продуктах без порога по выручке.
Большой объём запросов
Именно поэтому DeepSeek перевела на неё весь трафик V4 Pro — это самая доступная по стоимости модель линейки.
Кто уже работал с флагманом
Прямая замена: те же сценарии, но быстрее и с поддержкой изображений.
Задачи, требующие проверенных цифр
Часть бенчмарков — самоотчёт разработчика. Для критичных решений сверяйтесь на своей задаче.
Спецификация DeepSeek V4.1 Flash
- Разработчик
- DeepSeek (Китай)
- Дата выхода
- 10 сентября 2026
- Архитектура
- MoE, причинный энкодер-декодер
- Параметры
- 552 млрд (MoE) + ~196 млрд Engram
- Активные параметры
- 8 млрд вход / 16 млрд выход
- Вход
- текст, изображения
- Контекст
- 1 000 000 токенов
- Максимальный ответ
- 384 000 токенов
- Ускорение
- CSA2, FP4 KV-кеш, DSpark
- Лицензия
- MIT, открытые веса
- Заменяет
- V4 Pro, V4 Flash
Готовые запросы к DeepSeek V4.1 Flash
Подставьте своё вместо текста в скобках.
Как начать пользоваться, без VPN
Strelka AI работает из России напрямую, поэтому DeepSeek V4.1 Flash открывается как обычный сайт — без туннелей и разрывов. Регистрация на сайте DeepSeek не нужна.
Почта и пароль, интерфейс полностью русский.
Модель лежит в разделе текстовых нейросетей.
Обычными словами по-русски — переводить не нужно.
Рядом лежат и другие модели — удобно проверить один и тот же запрос на нескольких.
Начать можно бесплатно: при регистрации доступен пробный объём. Оплата — российскими картами, юрлицам доступны счёт и закрывающие документы — реквизиты на отдельной странице. Условия — в разделе тарифов: модель входит в общую подписку вместе с остальными 50+ нейросетями.
DeepSeek V4.1 Flash рядом с другими нейросетями
| Модель | Вход | Контекст | Особенность |
|---|---|---|---|
| DeepSeek V4.1 Flash | текст, изображения | 1 млн | заменила V4 Pro, открытые веса |
| DeepSeek V4 Pro | только текст | 1 млн | предыдущий флагман, запросы теперь ведёт Flash |
| GLM 5.3 | текст | 1 млн | открытые веса, долгие агентные задачи |
| Qwen 3.8 | текст, изображения | 1 млн | открытые веса, светлый технический интерфейс |
| Fugu Ultra v2 | текст, изображения, PDF | 1 млн | оркестратор пула моделей |
| Gemini 3.7 | текст, фото, аудио, видео, PDF | 1 млн | самый широкий набор входов |
Если V4.1 Flash не подходит под задачу
Вопросы про DeepSeek V4.1 Flash
01Что такое DeepSeek V4.1 Flash простыми словами
02Правда ли, что DeepSeek V4 Pro отключают
03Чем V4.1 Flash отличается от V4 Pro на странице Strelka AI
04Нужен ли VPN из России
05Работает ли модель с картинками
06Сколько текста помещается в контекст
07Открыты ли веса
08Почему модель называется Flash, а не Pro, если она сильнее
09Что такое спекулятивное декодирование DSpark
10Можно ли пользоваться бесплатно
11Кто разработал DeepSeek V4.1 Flash
12Как начать пользоваться
Попробуйте модель, которая обогнала свой же флагман
DeepSeek V4.1 Flash онлайн на русском, из России, без VPN и зарубежной карты. Рядом в подписке — и сама V4 Pro, есть с чем сравнить напрямую.
Источники
Официальное объявление о переносе запросов V4 Pro и базовые характеристики — по публикации самой DeepSeek. Технический разбор архитектуры, KV-кеша и спекулятивного декодирования — по материалу SiliconANGLE и статье Intelligent Living. Бенчмарки и позиция в рейтинге Vals.ai — по обзору DataCamp. Мы приводим цифры разработчика вместе с оговоркой к ним, а не только заявления.