Каталог О нас Тарифы Реквизиты Соглашение Паспорт Ступени Бенчмарки Задачи Вопросы
Preview · API с 20.09.2026

Step 5Preview

Агентная модель StepFun: 600 млрд параметров (27 млрд активных), контекст 1 млн токенов, текст, картинки и видео на входе. Открытые веса обещаны на 15 октября — разбираем цифры и честные оговорки.

1M600B27B 64KPREVIEW 123 45
600B / 27Bпараметров всего и активных на токен (разреженная MoE)
1 млнтокенов контекста; ответ — до 64K
3уровня усилия: low, medium, high
15.10заявленная дата открытых весов — пока не подтверждена
Паспорт

Что такое Step 5 Preview, коротко

Простыми словами

Step 5 Preview — предварительная версия крупной модели StepFun для длинных агентных задач: исследований, анализа документов, финансов и кода. Это разреженная MoE: сеть огромная (≈600B), но на каждый токен работает лишь малая часть (≈27B).

Сильные стороны — контекст 1 млн токенов, вход в виде текста, картинок и видео, цена токена ниже медианы. Слабые — тяжёлый кодинг, многословность и то, что почти все цифры принадлежат самой StepFun.

Разработчик
StepFun (Шанхай)
Анонс и API
20 сентября 2026
ID модели
step-5-preview
Статус
Preview — предварительная версия
Архитектура
Разреженная MoE: ≈600B всего, ≈27B активных на токен
Слои
92, «узкая и глубокая» компоновка (по Pandaily)
Контекст
1 000 000 токенов
Ответ
До 64 000 токенов
Вход
Текст, изображения (до 60 за запрос), видео
Выход
Только текст
Мышление
Уровни low, medium, high
Открытые веса
Заявлены на 15.10.2026 · не подтверждены

Параметры — по документации платформы StepFun и анонсу. Состав каталога в Strelka AI — в приложении.

Пять ступеней

Пять цифр, по которым растёт интерес

Каждая ступень — одна цифра с указанием источника. Пятая, янтарная, — единственная независимая оценка интеллекта.

СТУПЕНЬ 01
Контекст
1млн

токенов на входе; ответ — до 64 тыс. токенов

документация StepFun
СТУПЕНЬ 02
Параметров всего
600B

разреженная MoE: активна лишь малая часть сети

данные StepFun
СТУПЕНЬ 03
Активных на токен
27B

около 4,5% от всей модели — вот почему она быстрее плотной «600B»

данные StepFun
СТУПЕНЬ 04
Скорость вывода
99,8ток/с

медиана reasoning-моделей по Artificial Analysis — 64,6

независимый замер
СТУПЕНЬ 05
Intelligence Index
44

Artificial Analysis; медиана reasoning-моделей в сопоставимом классе — 24

независимый замер

Контекст и параметры — по документации и анонсу StepFun; скорость и индекс — Artificial Analysis (замер на API StepFun, начало публикации — 18–20 сентября 2026). Медиана — по группе сопоставимых моделей в оценке AA.

Бенчмарки

Шесть тестов, четыре соперника

Step 5 Preview против Kimi K3, GLM-5.3, GPT-6 Astra и Claude Opus 5. Карточки отсортированы по результату; выключайте лишних соперников кнопками.

Сравнить с Step 5 Preview

DeepSWE v1.1

Программная инженерия

GPT-6 Astra
74,1
Claude Opus 5
74,0
Step 5
67,7
Kimi K3
67,5
GLM-5.3
66,9
Step 5: 3-е место из 5

StepCodeBench

Бенчмарк самой StepFun: 553 репозитория, 33 языка

Claude Opus 5
63,9
GPT-6 Astra
61,0
Step 5
49,0
Kimi K3
43,9
GLM-5.3
40,2
Step 5: 3-е место из 5

ProgramBench

Программирование

GPT-6 Astra
85,4
Claude Opus 5
82,3
Step 5
80,5
Kimi K3
77,8
GLM-5.3
72,0
Step 5: 3-е место из 5

Terminal-Bench v4

Агентный кодинг в терминале

GPT-6 Astra
57,9
Claude Opus 5
52,3
GLM-5.3
41,9
Step 5
33,3
Kimi K3
12,6
Step 5: 4-е место из 5

FrontierFinance

Финансовый анализ

Claude Opus 5
69,7
Step 5
66,4
GLM-5.3
64,1
Kimi K3
62,6
GPT-6 Astra
55,0
Step 5: 2-е место из 5

DRACO

Глубокое исследование

Claude Opus 5
87,6
Step 5
83,3
GPT-6 Astra
76,8
Step 5: 2-е место из 3
5 из 5Kimi K3: тестов, где Step 5 Preview впереди (по данным StepFun)
4 из 5GLM-5.3: тестов, где Step 5 Preview впереди (по данным StepFun)
2 из 6GPT-6 Astra: тестов, где Step 5 Preview впереди (по данным StepFun)
0 из 6Claude Opus 5: тестов, где Step 5 Preview впереди (по данным StepFun)

Все цифры — данные StepFun в пересказе обзоров (MarkTechPost, eesel, BenchLM); независимо не воспроизведены. Основные тесты StepFun запускала на уровне High, у соперников — Max. Баллы разных тестов между собой не сопоставимы.

Независимые замеры

Что показал Artificial Analysis

Единственный внешний замер на 09.10.2026: интеллект выше медианы, скорость тоже — но модель многословна и догоняет, а не обгоняет.

Artificial Analysis Intelligence Index
44

Независимая сводная оценка. У Step 5 Preview — 44 против медианы 24 у reasoning-моделей в сопоставимом классе. По тому же индексу Kimi K3 и GLM-5.3 — тоже на уровне 44: лидером среди открытых она не стала.

При первой публикации (18.09.2026) модель заняла 25-е место из 200 в рейтинге AA.

Скорость выводав 1,5 раза выше медианы
Step 5
99,8 ток/с
Медиана
64,6 ток/с

Замер Artificial Analysis на API StepFun. Скорость зависит от нагрузки и тарифа — у вас она может отличаться.

Время до первого токенана 17% меньше медианы
Step 5
2,96 с
Медиана
≈3,57 с

Для рассуждающей модели это время включает «думание»: у короткого запроса оно может быть меньше, у сложного — заметно больше.

Цена токена на входна 47% ниже медианы
Step 5
−47%
Медиана
медиана

Относительно медианы сопоставимых моделей по оценке Artificial Analysis. Скидка на кэшированный вход — около 95%.

Цена токена на выводна 73% ниже медианы
Step 5
−73%
Медиана
медиана

В цену вывода входит и рассуждение модели — поэтому важна следующая строка.

Многословностьв 1,7 раза больше медианы
Step 5
160 млн
Медиана
≈92 млн

Столько выходных токенов модель выдала на индексе AA (оценки медианы — 90–92 млн). Частично это съедает выгоду от дешёвого токена.

Что отдать модели

Где она хороша, а где лучше другая

Восемь типовых задач с честным вердиктом. Это ориентир на основе опубликованных данных, а не приговор: проверяйте на своих промптах.

Сильная сторона

Длинные документы и ресёрч

Контекст 1 млн токенов и ответ до 64K; StepFun приводит пример: 950 обращений к веб-страницам в одном действии агента.

BrowseComp 88,7 и DRACO 83,3 — данные StepFun. На DRACO Claude Opus 5 — 87,6.

Сильная сторона

Финансовый анализ

FrontierFinance 66,4: выше GPT-6 Astra (55,0), Kimi K3 (62,6) и GLM-5.3 (64,1).

Данные StepFun. Claude Opus 5 — 69,7; Step 5 запускали на High, соперников — на Max.

С оговоркой

Агентные цепочки с инструментами

MCP Atlas 85,6 и Toolathlon-Verified 74,1 — сильные цифры в данных StepFun.

Ранние пользователи сообщали о частых ошибках вызова инструментов. Это не замеры, но проверьте свой сценарий.

С оговоркой

Кодинг средней сложности

DeepSWE v1.1 — 67,7: на уровне Kimi K3 (67,5) и GLM-5.3 (66,9), ниже GPT-6 Astra (74,1) и Claude Opus 5 (74,0).

Данные StepFun. Сложные задачи — см. следующую карточку.

С оговоркой

Разбор картинок и видео

На входе — до 60 изображений за запрос и видео (MP4, рекомендуемая длина — до 5 минут). MMMU-Pro — 76,4 по Artificial Analysis.

На выходе — только текст: картинки и видео модель не создаёт.

Не лучший выбор

Тяжёлый терминальный кодинг

Terminal-Bench v4: 33,3 против 57,9 у GPT-6 Astra и 52,3 у Claude Opus 5; GLM-5.3 — 41,9.

Данные StepFun в пересказе eesel. Для тяжёлых агентных задач есть более сильные варианты.

Лучше: Claude Sonnet 5.5, Claude Opus 5.5, GPT-6 Astra

Не лучший выбор

Быстрые короткие ответы

Модель «рассуждающая»: её ответ включает долгий вывод. AA зафиксировала 160 млн выходных токенов на индексе при медиане ≈92 млн.

Для живого чата и поддержки скорость и краткость важнее — смотрите быстрые модели.

Лучше: Claude Haiku 5.5 — по заявлению Anthropic, самая быстрая модель Claude

Не лучший выбор

Факты без проверки

AA-Omniscience: точность 41,5%, доля галлюцинаций 43,0% (Artificial Analysis).

Юридические, медицинские и финансовые факты всегда сверяйте по первоисточникам.

Возможности и API

Что умеет, как подключить

Восемь параметров из документации StepFun и пример вызова. Переключайте уровень усилия — код обновится.

Контекст1 млн токенов на входе. В стороннем конфиге встречалось 350 тыс. — см. оговорки.
ВыводДо 64 тыс. токенов за ответ; max_tokens по умолчанию не ограничен — длину выбирает модель.
ВходТекст, до 60 изображений (JPG, PNG, WebP, GIF) и видео (MP4, QuickTime, Matroska).
ВыходТолько текст.
ИнструментыВызов функций поддерживается. Поиск и выполнение кода даёт приложение, сама модель во внешний мир не ходит.
ФорматJSON Mode, JSON Schema и потоковый вывод.
КэшPrompt caching: на повторный вход скидка около 95% (Artificial Analysis).
МышлениеТри уровня: low, medium, high — параметр reasoning_effort.

Параметры — по документации платформы StepFun. API совместим с OpenAI; для Messages API используется output_config.effort. Код — иллюстрация: адрес и ключ берите в документации.

Открытые веса

15 октября: обещание или релиз?

Хроника Step 5 Preview: от первого появления в рейтинге до заявленного открытия весов. Статус каждого шага — отдельной меткой.

  1. 1
    18.09.2026

    Модель появилась в Artificial Analysis

    Под меткой step-5-preview-b: индекс 44, 99,8 ток/с. Официального анонса ещё не было.

    Подтверждено AA
  2. 2
    20.09.2026

    Анонс и открытие API

    StepFun представила Step 5 Preview: платный API и Studio открылись в тот же день.

    Подтверждено
  3. 3
    08.10.2026

    Репозиторий весов пока пуст

    stepfun-ai/Step-5-Preview-BF16 создан 20 сентября, в нём только служебный файл: нет весов, карточки модели и лицензии. По данным обзоров на 08–09.10.2026.

    Проверено обзорами
Как начать

Три шага и три промпта

Длинный контекст и многословие лучше проверить самому: возьмите одни и те же запросы и сравните две модели.

1

Откройте приложение

Зайдите в app.strelka.ai: без VPN и без зарубежной карты, оплата — российской картой.

2

Выберите модель

Найдите Step 5 Preview в каталоге или возьмите другую топовую модель для сравнения. Состав каталога смотрите в приложении — он меняется.

3

Проверьте на своих задачах

Скопируйте промпты ниже, засеките время и объём ответа, сравните две модели на одном и том же запросе.

Промпт 1 · Договоры

Сверка на сотни страниц

Вот два договора. Составь таблицу расхождений по срокам, оплате и ответственности и укажи, на какой странице что нашёл. [вставьте тексты]
Промпт 2 · Финансы

Разбор отчётности

Разбери отчётность за три года: выручка, маржа, долг. Выдели три риска и три вопроса менеджменту. Помечай цифры, в которых не уверен. [вставьте данные]
Промпт 3 · Ресёрч

Обзор с пробелами

Собери обзор по теме [тема]: 10 ключевых тезисов, где источники расходятся и что осталось неизвестным. Отмечай, где данных не хватает.
Честно

Семь оговорок, которые лучше знать заранее

Хорошая новость выглядит убедительнее, когда рядом написаны границы.

  1. Почти все цифры — данные StepFun

    Технического отчёта нет, а StepCodeBench — собственный бенчмарк StepFun. Независимы только замеры Artificial Analysis. Основные тесты StepFun запускала на High, соперников — на Max: сравнение не вполне симметрично.

  2. Это Preview

    Название, цена и доступность могут измениться, когда суффикс «Preview» уберут. Эндпоинт может быть ограничен по мощности, а на старте — менее стабилен, чем у зрелых моделей.

  3. Дешёвый токен — не всегда дешёвая задача

    Модель многословна: 160 млн выходных токенов на индексе AA против ≈92 млн медианы. Рецензенты в обсуждениях пишут, что она «рассуждает слишком долго». Итог зависит от ваших промптов.

  4. Первые отзывы о вызове инструментов — неважные

    Ранние тестеры сообщали об ошибках вызова инструментов, сбоях после ≈340 тыс. токенов контекста и обрезанных ответах. Это анекдотичные сообщения, не измерения, но агентный сценарий стоит проверить заранее.

  5. Размер контекста: проверьте на своём объёме

    1 млн токенов заявлен StepFun и виден в AA, но в стороннем конфиге встречалось 350 тыс. токенов. Прежде чем строить продукт на длинном контексте, прогоните свой объём.

  6. Открытые веса — пока обещание

    Дата 15 октября не подтверждена, репозиторий пуст, лицензии нет. Не планируйте инфраструктуру, пока веса и условия не опубликованы.

  7. Галлюцинации и безопасность

    AA-Omniscience: точность 41,5% и доля галлюцинаций 43,0%. Сведений о тестах безопасности в найденных материалах нет. Для критичных данных нужна проверка по источникам.

Вопросы

Частые вопросы о Step 5 Preview

Что такое Step 5 Preview?
Step 5 Preview — агентная модель компании StepFun: разреженная MoE примерно на 600 млрд параметров, из которых около 27 млрд активны на токен. Контекст — 1 млн токенов, на входе принимает текст, изображения и видео, отвечает текстом. API открылся 20 сентября 2026 года.
Кто выпустил Step 5 Preview?
Модель выпустила StepFun — китайская ИИ-компания из Шанхая, известная линейкой Step (Step 3.5 Flash, Step 3.7 Flash). Strelka AI не связана с StepFun, а страница отражает собственный разбор по открытым источникам.
Какой контекст и какой максимальный ответ у Step 5 Preview?
По документации StepFun: контекст — 1 млн токенов, максимальный ответ — 64 тыс. токенов. В одном стороннем конфиге встречалось 350 тыс. токенов контекста, поэтому объём лучше проверить на своих данных.
Насколько Step 5 Preview сильна по сравнению с Claude Opus 5 и GPT-6 Astra?
По данным StepFun, Step 5 Preview ниже Claude Opus 5 во всех шести сравнимых тестах и ниже GPT-6 Astra в четырёх из шести; впереди Astra — в FrontierFinance и DRACO. От Kimi K3 она впереди в пяти тестах из пяти, от GLM-5.3 — в четырёх из пяти (кроме Terminal-Bench v4). Основные тесты StepFun запускала на High, соперников — на Max.
Что с открытыми весами Step 5 Preview?
StepFun обещает открыть веса 15 октября 2026 года, но на 08–09.10.2026 репозиторий на Hugging Face пуст, а лицензия не опубликована. Для запуска BF16-весов потребуется около 1,2 ТБ памяти без учёта KV-кэша — это многоГПУ-сервер.
Какие независимые замеры есть у Step 5 Preview?
Artificial Analysis дал Intelligence Index 44 (медиана reasoning-моделей в сопоставимом классе — 24), скорость вывода 99,8 токена в секунду (медиана — 64,6) и время до первого токена около 3 секунд. Одновременно модель многословна: 160 млн выходных токенов на индексе против медианы ≈92 млн.
Дорого ли пользоваться Step 5 Preview?
По оценке Artificial Analysis, токены Step 5 Preview заметно дешевле медианы сопоставимых моделей: вход — примерно на 47%, вывод — на 73%, а скидка на кэшированный вход около 95%. Но модель многословна, поэтому итог зависит от задачи. Условия работы в Strelka AI смотрите на странице тарифов.
Подходит ли Step 5 Preview для программирования?
Для задач средней сложности — да: DeepSWE v1.1 67,7 на уровне Kimi K3 и GLM-5.3. Для тяжёлого терминального кодинга (Terminal-Bench v4 — 33,3) лучше посмотреть Claude Sonnet 5.5, Claude Opus 5.5 или GPT-6 Astra.
Как попробовать Step 5 Preview из России без VPN?
Откройте приложение app.strelka.ai: оно работает из России без VPN и без зарубежной карты, оплата — российской картой. Состав каталога смотрите в приложении; пока выбираете, сравните несколько топовых моделей на одних и тех же промптах. Подробнее — в подборке нейросетей без VPN.
Что значит «Preview» и можно ли использовать модель в продакшене?
«Preview» — предварительная версия: цена, название и ограничения могут измениться. Технического отчёта нет, а бенчмарки в основном принадлежат самой StepFun. Перед продакшеном прогоните модель на своих данных и сравните с альтернативами, например из подборки новых нейросетей 2026.
Источники: MarkTechPost, Документация StepFun, BenchLM, eesel AI, OrcaRouter: утечка, OrcaRouter: открытые веса, Pandaily, Activepieces. Данные сверены на 09.10.2026. Бенчмарки — данные StepFun в пересказе обзоров, независимые — только Artificial Analysis; часть цифр обзоров противоречива, в таких случаях мы указывали оба значения. Step и StepFun — названия, принадлежащие их владельцам; Strelka AI не связана со StepFun. Страница отражает позицию Strelka AI и не является инвестиционной или технической рекомендацией.

Пятая ступень. Проверьте сами.

Сравните Step 5 Preview и другие топовые модели на своих задачах. Без VPN и без зарубежной карты.