DeepSeek R1 — нейросеть, которая думает вслух и сама себя проверяет
Открытые веса по лицензии MIT, пошаговые рассуждения с самопроверкой и результаты уровня лучших моделей своего времени на математике, логике и коде. В Strelka AI — из России, без VPN и зарубежной карты, по общей подписке с остальным каталогом.
Что такое DeepSeek R1
Модель китайской компании DeepSeek, вышедшая 20 января 2025 года и ставшая одним из главных технологических событий того месяца: впервые открытая модель показала рассуждения уровня закрытых лидеров рынка.
R1 — не просто чат-модель, а модель, специально обученная рассуждать перед ответом. Вместо того чтобы сразу выдавать результат, она пишет цепочку промежуточных шагов, проверяет их по ходу и может вернуться назад, если находит ошибку. Это устроено на архитектуре MoE (mixture-of-experts) — 671 млрд параметров всего, но на каждый токен активны лишь около 37 млрд, что держит скорость ответа разумной при таком размере модели.
Обучение шло в два этапа: сперва модель прошла «холодный старт» — небольшой набор размеченных примеров рассуждений, — а затем два раунда обучения с подкреплением по методу GRPO (Group Relative Policy Optimization), который не требует отдельной модели-критика. Именно на этом этапе появилось поведение, которое исследователи в своей статье назвали «aha moment»: модель без специальной подсказки начала самостоятельно останавливаться на подозрительных шагах и пересматривать рассуждение — то же самое показано в иллюстрации выше.
28 мая 2025 года вышло обновление R1-0528, повысившее точность на более новых наборах задач и удлинившее рассуждения на сложных вопросах — этот чекпоинт и обслуживает модель в каталоге Strelka AI сегодня.
Как она рассуждает
Пошаговые рассуждения
Перед ответом модель разворачивает цепочку промежуточных шагов — ход мысли виден, а не скрыт внутри одного финального сообщения.
Самопроверка и возврат к ошибке
Замечает подозрительный шаг прямо по ходу рассуждения, останавливается и пересматривает вывод — эмерджентное поведение, а не жёсткий сценарий.
Математика и логика
79,8% на AIME 2024 и 97,3% на MATH-500 — от школьной олимпиадной математики до многошаговых логических задач.
Код и алгоритмы
Рейтинг 2029 на Codeforces — 96,3-й процентиль среди участников площадки — и 49,2% решённых задач на SWE-bench Verified.
Научные и мультидисциплинарные задачи
71,5% на GPQA Diamond — тест из вопросов уровня аспирантуры по физике, химии и биологии, где нельзя угадать ответ поиском.
Прозрачный ход мысли
Видимая цепочка рассуждений полезна не только для ответа: по ней удобно объяснять решение — например, студенту или коллеге.
Цифры и бенчмарки
Результаты из технического отчёта DeepSeek-R1 — независимые тесты на реальных задачах, а не самооценка на своих примерах.
Дополнительно: 49,2% решённых задач на SWE-bench Verified — тесте на исправление настоящих issue в открытых репозиториях.
Открытые веса и дистилляция
Веса DeepSeek R1 опубликованы по лицензии MIT — самой свободной из распространённых лицензий: их можно скачать, изучить, дообучить и использовать в своих продуктах, включая коммерческие. Это редкость среди моделей такого уровня результатов — большинство сопоставимых по качеству рассуждений моделей закрыты.
На основе R1 сделаны шесть дистиллированных версий — от 1,5 до 70 млрд параметров, на базе Qwen2.5 (1,5B, 7B, 14B, 32B) и Llama 3 (8B, 70B). Они переняли стиль рассуждений старшей модели и на равных тестах обходят модели сопоставимого размера, обученные без такой дистилляции:
В каталоге Strelka AI доступна полная модель DeepSeek R1 — самостоятельный запуск открытых весов на своём железе сюда не входит и остаётся отдельной опцией для тех, кому это нужно.
Кому подойдёт
Студенты и репетиторы
Решение задач по математике и физике с видимым ходом рассуждения — удобно проверять и объяснять шаги, а не только ответ.
Программисты
Алгоритмические задачи, разбор чужого кода и отладка логики — рейтинг 2029 на Codeforces говорит о силе именно в таких задачах.
Исследователи и аналитики
Многошаговые задачи, где важно проверить логику вывода, а не только получить итоговое число.
Те, кому важна прозрачность
Видимая цепочка рассуждений и открытые веса по лицензии MIT — для тех, кто хочет понимать, как модель пришла к ответу.
Как получить доступ без VPN
Регистрация
Заходите на Strelka AI и создаёте аккаунт по почте — без иностранного номера телефона.
Каталог
Открываете DeepSeek R1 в общем каталоге моделей — переключаться между сервисами не нужно.
Задача
Формулируете задачу на русском — модель сама выстроит рассуждение и покажет ход решения.
Оплата
Российской картой, без валютных операций и зарубежных сервисов.
Спецификация
- Разработчик
- DeepSeek
- Дата выхода
- 20 января 2025
- Параметры
- 671 млрд / 37 млрд активных
- Архитектура
- MoE + рассуждение через RL
- Контекст
- 128 000 токенов
- Обучение
- SFT (cold-start) + GRPO
- Лицензия
- MIT, открытые веса
- Дистиллированные версии
- 1,5B — 70B, Qwen / Llama
Промпты для старта
Реши задачу и покажи каждый шаг рассуждения отдельно: [условие задачи]. Если на каком-то шаге усомнишься — прямо напиши об этом и пересчитай.
Вот функция: [код]. Найди в ней логическую ошибку, объясни, почему она возникает, и предложи исправление с новым тестом.
Объясни [сложную тему] так, будто готовишь меня к экзамену: сначала логика на пальцах, потом формальное определение, потом пример на конкретных числах.
Вот моё решение задачи: [решение]. Проверь каждый шаг на ошибки, ничего не пропуская, и укажи конкретное место, если что-то не сходится.
Что учесть
128 000 токенов — хороший объём для задачи или документа средней длины, но заметно меньше, чем у более новых моделей вроде DeepSeek V4 Pro с её 1 000 000 токенов. Для очень больших документов и многофайловых проектов лучше подойдёт V4 Pro.
На трудных задачах модель может «думать» десятки тысяч токенов, прежде чем показать ответ — это осознанный компромисс в пользу точности, но на простых вопросах, где такая глубина не нужна, ответ может показаться дольше, чем у чисто «быстрых» моделей.
DeepSeek R1 или DeepSeek V4 Pro
DeepSeek R1
- Специализация на пошаговых рассуждениях с самопроверкой
- Контекст 128 000 токенов
- Открытые веса по лицензии MIT
- Лучший выбор для математики, логики и алгоритмических задач
DeepSeek V4 Pro
- Универсальная модель нового поколения на разреженном внимании
- Контекст 1 000 000 токенов
- Более быстрые ответы на задачах общего профиля
- Лучший выбор для больших документов и объёмных проектов
Частые вопросы про DeepSeek R1
01Что такое DeepSeek R1 простыми словами
02Чем DeepSeek R1 отличается от DeepSeek V4 Pro
03Нужен ли VPN, чтобы пользоваться DeepSeek R1 из России
04Нужна ли зарубежная карта или иностранный номер телефона
05Что значит «открытые веса» и зачем это обычному пользователю
06Что такое дистиллированные версии R1
07Что означают цифры AIME, MATH-500 и Codeforces
08Что такое «aha moment» и самопроверка модели
09Почему модель иногда отвечает дольше, чем другие
10Можно ли начать пользоваться бесплатно
11Для каких задач DeepSeek R1 подходит лучше всего
12Как начать пользоваться DeepSeek R1 без VPN
Поставьте задачу и посмотрите на ход рассуждения
DeepSeek R1 в общем каталоге Strelka AI — без VPN, зарубежной карты и отдельной регистрации на сайте DeepSeek.
Архитектура, обучение и бенчмарки — по официальному техническому отчёту «DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning», включая таблицы результатов основной модели и дистиллированных версий. Дата обновления R1-0528 — по карточке модели на Open Laboratory. Про то, как тему подают на русском рынке — по разборам на Habr и vc.ru. Иллюстрация хода рассуждения на этой странице — наш собственный поясняющий пример, а не дословная цитата ответа модели. Мы не переносим сюда чужие цены и рейтинги сторонних сервисов — только факты о модели.