Каталог О нас Тарифы Реквизиты Соглашение Бенчмарки Доступ без VPN Вопросы
Strelka AI · DeepSeek R1

DeepSeek R1 — нейросеть, которая думает вслух и сама себя проверяет

Открытые веса по лицензии MIT, пошаговые рассуждения с самопроверкой и результаты уровня лучших моделей своего времени на математике, логике и коде. В Strelka AI — из России, без VPN и зарубежной карты, по общей подписке с остальным каталогом.

79,8%AIME 2024 — соревновательная математика
97,3%MATH-500 — сложные математические задачи
MITоткрытые веса, доступны для скачивания
0VPN и зарубежных карт для доступа из России
01

Что такое DeepSeek R1

Модель китайской компании DeepSeek, вышедшая 20 января 2025 года и ставшая одним из главных технологических событий того месяца: впервые открытая модель показала рассуждения уровня закрытых лидеров рынка.

R1 — не просто чат-модель, а модель, специально обученная рассуждать перед ответом. Вместо того чтобы сразу выдавать результат, она пишет цепочку промежуточных шагов, проверяет их по ходу и может вернуться назад, если находит ошибку. Это устроено на архитектуре MoE (mixture-of-experts) — 671 млрд параметров всего, но на каждый токен активны лишь около 37 млрд, что держит скорость ответа разумной при таком размере модели.

Обучение шло в два этапа: сперва модель прошла «холодный старт» — небольшой набор размеченных примеров рассуждений, — а затем два раунда обучения с подкреплением по методу GRPO (Group Relative Policy Optimization), который не требует отдельной модели-критика. Именно на этом этапе появилось поведение, которое исследователи в своей статье назвали «aha moment»: модель без специальной подсказки начала самостоятельно останавливаться на подозрительных шагах и пересматривать рассуждение — то же самое показано в иллюстрации выше.

28 мая 2025 года вышло обновление R1-0528, повысившее точность на более новых наборах задач и удлинившее рассуждения на сложных вопросах — этот чекпоинт и обслуживает модель в каталоге Strelka AI сегодня.

02

Как она рассуждает

Пошаговые рассуждения

Перед ответом модель разворачивает цепочку промежуточных шагов — ход мысли виден, а не скрыт внутри одного финального сообщения.

Самопроверка и возврат к ошибке

Замечает подозрительный шаг прямо по ходу рассуждения, останавливается и пересматривает вывод — эмерджентное поведение, а не жёсткий сценарий.

Математика и логика

79,8% на AIME 2024 и 97,3% на MATH-500 — от школьной олимпиадной математики до многошаговых логических задач.

Код и алгоритмы

Рейтинг 2029 на Codeforces — 96,3-й процентиль среди участников площадки — и 49,2% решённых задач на SWE-bench Verified.

Научные и мультидисциплинарные задачи

71,5% на GPQA Diamond — тест из вопросов уровня аспирантуры по физике, химии и биологии, где нельзя угадать ответ поиском.

Прозрачный ход мысли

Видимая цепочка рассуждений полезна не только для ответа: по ней удобно объяснять решение — например, студенту или коллеге.

03

Цифры и бенчмарки

Результаты из технического отчёта DeepSeek-R1 — независимые тесты на реальных задачах, а не самооценка на своих примерах.

79,8%AIME 2024 — олимпиадная математика
97,3%MATH-500 — сложные математические задачи
71,5%GPQA Diamond — вопросы уровня аспирантуры
90,8%MMLU — общие знания по широкому кругу тем
2029Codeforces — рейтинг, 96,3-й процентиль

Дополнительно: 49,2% решённых задач на SWE-bench Verified — тесте на исправление настоящих issue в открытых репозиториях.

04

Открытые веса и дистилляция

Веса DeepSeek R1 опубликованы по лицензии MIT — самой свободной из распространённых лицензий: их можно скачать, изучить, дообучить и использовать в своих продуктах, включая коммерческие. Это редкость среди моделей такого уровня результатов — большинство сопоставимых по качеству рассуждений моделей закрыты.

На основе R1 сделаны шесть дистиллированных версий — от 1,5 до 70 млрд параметров, на базе Qwen2.5 (1,5B, 7B, 14B, 32B) и Llama 3 (8B, 70B). Они переняли стиль рассуждений старшей модели и на равных тестах обходят модели сопоставимого размера, обученные без такой дистилляции:

R1-Distill-Qwen-32B — AIME 202472,6%
Дистиллированная 32B-модель на базе рассуждений R1
QwQ-32B-Preview — AIME 202450,0%
Модель того же размера без дистилляции от R1, для сравнения

В каталоге Strelka AI доступна полная модель DeepSeek R1 — самостоятельный запуск открытых весов на своём железе сюда не входит и остаётся отдельной опцией для тех, кому это нужно.

05

Кому подойдёт

Учёба

Студенты и репетиторы

Решение задач по математике и физике с видимым ходом рассуждения — удобно проверять и объяснять шаги, а не только ответ.

Разработка

Программисты

Алгоритмические задачи, разбор чужого кода и отладка логики — рейтинг 2029 на Codeforces говорит о силе именно в таких задачах.

Анализ

Исследователи и аналитики

Многошаговые задачи, где важно проверить логику вывода, а не только получить итоговое число.

Открытость

Те, кому важна прозрачность

Видимая цепочка рассуждений и открытые веса по лицензии MIT — для тех, кто хочет понимать, как модель пришла к ответу.

06

Как получить доступ без VPN

01

Регистрация

Заходите на Strelka AI и создаёте аккаунт по почте — без иностранного номера телефона.

02

Каталог

Открываете DeepSeek R1 в общем каталоге моделей — переключаться между сервисами не нужно.

03

Задача

Формулируете задачу на русском — модель сама выстроит рассуждение и покажет ход решения.

04

Оплата

Российской картой, без валютных операций и зарубежных сервисов.

07

Спецификация

Разработчик
DeepSeek
Дата выхода
20 января 2025
Параметры
671 млрд / 37 млрд активных
Архитектура
MoE + рассуждение через RL
Контекст
128 000 токенов
Обучение
SFT (cold-start) + GRPO
Лицензия
MIT, открытые веса
Дистиллированные версии
1,5B — 70B, Qwen / Llama
08

Промпты для старта

Математика

Реши задачу и покажи каждый шаг рассуждения отдельно: [условие задачи]. Если на каком-то шаге усомнишься — прямо напиши об этом и пересчитай.

Код и алгоритмы

Вот функция: [код]. Найди в ней логическую ошибку, объясни, почему она возникает, и предложи исправление с новым тестом.

Разбор понятия

Объясни [сложную тему] так, будто готовишь меня к экзамену: сначала логика на пальцах, потом формальное определение, потом пример на конкретных числах.

Проверка вывода

Вот моё решение задачи: [решение]. Проверь каждый шаг на ошибки, ничего не пропуская, и укажи конкретное место, если что-то не сходится.

09

Что учесть

Контекст меньше, чем у новых моделей

128 000 токенов — хороший объём для задачи или документа средней длины, но заметно меньше, чем у более новых моделей вроде DeepSeek V4 Pro с её 1 000 000 токенов. Для очень больших документов и многофайловых проектов лучше подойдёт V4 Pro.

Рассуждение занимает время

На трудных задачах модель может «думать» десятки тысяч токенов, прежде чем показать ответ — это осознанный компромисс в пользу точности, но на простых вопросах, где такая глубина не нужна, ответ может показаться дольше, чем у чисто «быстрых» моделей.

10

DeepSeek R1 или DeepSeek V4 Pro

DeepSeek R1

  • Специализация на пошаговых рассуждениях с самопроверкой
  • Контекст 128 000 токенов
  • Открытые веса по лицензии MIT
  • Лучший выбор для математики, логики и алгоритмических задач

DeepSeek V4 Pro

  • Универсальная модель нового поколения на разреженном внимании
  • Контекст 1 000 000 токенов
  • Более быстрые ответы на задачах общего профиля
  • Лучший выбор для больших документов и объёмных проектов
Страница DeepSeek V4 Pro →
11

Частые вопросы про DeepSeek R1

01Что такое DeepSeek R1 простыми словами
Это модель DeepSeek, обученная специально рассуждать: перед ответом она пишет цепочку шагов, проверяет их и при необходимости возвращается и исправляет ошибку — вместо того чтобы сразу выдать готовый ответ.
02Чем DeepSeek R1 отличается от DeepSeek V4 Pro
V4 Pro — более новая и универсальная модель с контекстом 1 000 000 токенов для больших документов и задач общего назначения. R1 — специализированный рассуждатель для математики, логики и кода с открытыми весами по лицензии MIT, которые можно скачать и запустить самостоятельно.
03Нужен ли VPN, чтобы пользоваться DeepSeek R1 из России
Нет. В Strelka AI модель открывается из России напрямую, без VPN, прокси и замедлений.
04Нужна ли зарубежная карта или иностранный номер телефона
Нет. Регистрация и оплата — российской картой, номер телефона не нужен, отдельный аккаунт на сайте DeepSeek заводить не требуется.
05Что значит «открытые веса» и зачем это обычному пользователю
Веса модели опубликованы по лицензии MIT в открытом доступе — их может скачать и изучить любой разработчик, а не только компания-владелец. Для пользователя Strelka AI это не меняет способ работы с моделью, но объясняет, почему на её основе появилось так много бесплатных инструментов и дистиллированных версий.
06Что такое дистиллированные версии R1
Это уменьшенные модели от 1,5 до 70 миллиардов параметров на базе Qwen и Llama, обученные повторять ход рассуждений полной R1. Они слабее оригинала, но переносят это поведение вниз по размеру: например, DeepSeek-R1-Distill-Qwen-32B заметно опережает более крупную QwQ-32B-Preview на тех же тестах.
07Что означают цифры AIME, MATH-500 и Codeforces
Это независимые тесты на реальных задачах: AIME 2024 — соревновательная математика для школьников (79,8% решений), MATH-500 — сложные математические задачи (97,3%), Codeforces — рейтинг на спортивном программировании (2029 очков, 96,3-й процентиль среди участников площадки).
08Что такое «aha moment» и самопроверка модели
Так исследователи DeepSeek назвали момент в статье о R1, когда модель во время обучения самостоятельно, без специальной подсказки, начала останавливаться на подозрительном шаге, писать что-то вроде «постойте, здесь ошибка» и пересматривать рассуждение. На этой странице показан иллюстративный пример именно такого поведения.
09Почему модель иногда отвечает дольше, чем другие
На сложных задачах R1 может провести пошаговое рассуждение в несколько десятков тысяч токенов, прежде чем показать финальный ответ — это осознанный компромисс: больше времени на размышление ради более надёжного результата на трудных задачах.
10Можно ли начать пользоваться бесплатно
Да, при регистрации доступен пробный объём, которого хватит проверить модель на своих задачах, прежде чем оформлять подписку.
11Для каких задач DeepSeek R1 подходит лучше всего
Математика и олимпиадные задачи, логические головоломки, разбор алгоритмов и кода, доказательства и любые задачи, где важно увидеть не только ответ, но и ход рассуждения — например, чтобы объяснить решение студенту.
12Как начать пользоваться DeepSeek R1 без VPN
Зарегистрируйтесь на Strelka AI, откройте DeepSeek R1 в каталоге и опишите задачу на русском — без VPN и установки отдельных приложений.

Поставьте задачу и посмотрите на ход рассуждения

DeepSeek R1 в общем каталоге Strelka AI — без VPN, зарубежной карты и отдельной регистрации на сайте DeepSeek.

На чём основан разбор

Архитектура, обучение и бенчмарки — по официальному техническому отчёту «DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning», включая таблицы результатов основной модели и дистиллированных версий. Дата обновления R1-0528 — по карточке модели на Open Laboratory. Про то, как тему подают на русском рынке — по разборам на Habr и vc.ru. Иллюстрация хода рассуждения на этой странице — наш собственный поясняющий пример, а не дословная цитата ответа модели. Мы не переносим сюда чужие цены и рейтинги сторонних сервисов — только факты о модели.