Самая крупная модель, чьи веса пообещали выложить открыто. Два с половиной триллиона параметров в облаке — и младшая сестра на двадцать семь миллиардов, которую можно скачать и запустить на своей машине.
В поколении 3.8 вышли две модели, и младшая — не урезанная копия старшей. У них разная архитектура, разный контекст и разное назначение: одна живёт в облаке, вторая помещается на рабочую станцию. Нажмите, чтобы посмотреть сводку.
Флагман линейки и на момент выхода самая крупная модель, чьи веса обещали выложить открыто. Разреженная архитектура: из 2,4 трлн параметров на каждый токен работают 95 млрд, поэтому счёт идёт по активной части, а не по всей массе.
| Параметров всего | 2,4 трлн |
| Активных на токен | 95 млрд |
| Архитектура | разреженная MoE |
| Контекст | 1 000 000 токенов |
| Вход | текст, изображения, видео |
| Вышла | 3 августа 2026 |
У Alibaba давно две линейки: младшие модели выкладывают открыто, старшие держат в облаке. Qwen3.8-Max ломает это правило — компания объявила, что выложит веса флагмана. Конкретную лицензию для Max на момент анонса не назвали; у младшей 27B она уже известна и это Apache 2.0.
Для работы через Strelka AI скачивать ничего не нужно: это обычный чат в браузере. Открытость важна не потому, что вы будете разворачивать модель сами, а потому, что её проверяют со стороны — и она никуда не денется.
Столько текста модель держит перед глазами за один запрос — примерно 2,5 млн знаков, около 1400 страниц или пять средних книг. Для сравнения, вот сколько у соседей по каталогу.
Пересчёт в страницы приблизительный: один токен — примерно 2,5 знака русского текста, страница — 1800 знаков. На вашем материале цифры сдвинутся, но порядок будет такой.
Сильная сторона 3.8 — работа за компьютером и разбор длинных материалов. По собственным замерам Alibaba это её лучшие категории.
Модель управляет интерфейсом как человек: открывает окна, заполняет поля, переключается между программами. На OSWorld-Verified — тесте именно на это — заявлено 86,1 против 73,3 у прошлого поколения.
Текст, изображения и видео идут на вход нативно. Отдельная расшифровка ролика не нужна — редкость на этом уровне, большинство конкурентов принимают только текст и картинки.
PaperBench проверяет, сможет ли модель повторить научную работу по её описанию. Заявленные 93,0 против 64,8 у прошлого поколения — самый большой прирост в линейке.
Terminal-Bench 86,6 и SWE-bench Pro 67,7 по заявлению разработчика. Модель доводит задачу до конца сама: пишет, запускает, смотрит на ошибку и правит.
Рассуждение переключается между low, medium и xhigh. По умолчанию стоит максимальный: модель думает дольше, но точнее. На простых вопросах уровень имеет смысл снизить.
Миллион токенов вмещает пачку договоров, выгрузку переписки или средний репозиторий целиком. Модель сравнивает документы между собой, а не пересказывает по очереди.
Цифры опубликованы самой Alibaba — независимых сводных замеров по 3.8-Max на момент выхода страницы ещё не было. Сравнение идёт с Qwen3.7-Max.
Сравнение с Qwen3.6-27B того же размера. Обратите внимание на DeepSWE: рост втрое.
Это касается только Qwen3.8-27B: старшая модель на своей машине не запустится ни при каких условиях. И главное, о чём обычно забывают: файл весов — не весь счёт. Память нужна ещё и под кэш контекста.
| Формат | Вес модели | Что нужно на деле |
|---|---|---|
| BF16официальный | 51,76 ГиБ | около 68 ГиБ вместе с кэшем контекста на полную длину |
| FP8официальный | 28,76 ГиБ | плюс кэш сверху — по объёму контекста, который вам нужен |
| GGUF 4 битасторонний | около 16 ГиБ | влезает в 24 ГБ видеопамяти при умеренном контексте |
Если разворачивать у себя не хочется, а модель нужна — в Strelka AI обе доступны как обычный чат, без установки и без видеокарты.
Сильные стороны 3.8 — объём материала, видео на входе и работа за компьютером. Там, где нужен быстрый короткий ответ, берите модель полегче из того же каталога.
Запись вебинара, экранкаст, видеоинструкция — модель смотрит их напрямую и отвечает по содержанию. Не нужно сначала прогонять звук через распознавание, а потом отдавать текст: это экономит шаг и не теряет то, что было показано, а не сказано.
Заполнить форму, перенести данные между окнами, пройти цепочку кликов. Именно за это отвечает OSWorld-Verified, и там у 3.8 один из лучших результатов среди опубликованных.
PaperBench проверяет способность воспроизвести научную статью по описанию — и это категория, где 3.8-Max заявляет лучший результат из протестированных. Полезно, когда нужно не пересказать статью, а проверить её на своих данных.
Если данные нельзя выпускать наружу, младшая 27B под Apache 2.0 разворачивается внутри компании. В четырёхбитном формате она укладывается примерно в 16 ГиБ и работает на одной рабочей станции.
Данные Alibaba и профильных изданий на август 2026 года.
| Разработчик | Alibaba, линейка Qwen |
| Вышла | Qwen3.8-Max — 3 августа 2026, Qwen3.8-27B — 14 августа 2026 |
| Параметров у Max | 2,4 трлн, из них 95 млрд активных на токен |
| Архитектура Max | разреженная MoE на основе Qwen 3.5 |
| Параметров у 27B | 27,78 млрд, плотная гибридная модель |
| Слои у 27B | 48 Gated DeltaNet и 16 слоёв полного внимания |
| Контекст | 1 000 000 токенов у Max, 262 144 у 27B (до 1 млн через YaRN) |
| Вход | текст, изображения, видео |
| Выход | текст |
| Рассуждение | low, medium, xhigh — по умолчанию xhigh |
| Веса | у 27B открыты под Apache 2.0; для Max открытие объявлено, лицензия не названа |
| Доступ в Strelka AI | из России, без VPN и зарубежных карт |
Три вещи, о которых стоит знать заранее.
Замеры, которые вы видите выше, опубликовала сама Alibaba. Независимых сводных рейтингов по 3.8-Max на момент выхода этой страницы ещё не появилось, так что относитесь к ним как к заявке, а не как к подтверждённому результату.
Открытие весов флагмана объявлено, но под какой именно лицензией — компания не сообщила. Если для вас принципиально коммерческое использование модели у себя, ориентируйтесь пока на 27B: у неё Apache 2.0.
Уровень усилия xhigh стоит по умолчанию: модель строит длинную цепочку рассуждений и только потом отвечает. На сложной задаче это окупается, на коротком вопросе — нет, и уровень стоит понизить.
Qwen 3.8 и ещё полсотни нейросетей в одном окне. Из России, без VPN и зарубежных карт.