Каталог О нас Тарифы Реквизиты Соглашение Что нового Бенчмарки Бесплатно Вопросы
Anthropic · Claude Opus 4.8 · выпуск 28.05.2026

Модель, которая не пропускает то, что должна была заметить

Claude Opus 4.8 — флагман Anthropic для ревью кода, аудита и сложных агентных задач. По данным разработчика, она примерно в 4 раза реже пропускает дефекты кода незамеченными, чем предшественница, и чаще прямо признаёт неуверенность вместо правдоподобной выдумки.

Пробный доступ при регистрации · без VPN и зарубежной карты
REVIEW · claude-opus-4-8 проверяет себя
Строка 3: если promo окажется None — упадёт с исключением. Проверка на существование кода не найдена выше по функции.
Строка 6: диапазон rate подтверждён проверкой выше по стеку вызовов — подставлять без опаски можно.
1 место отмечено · 0 пропущено незамеченным
69,2%SWE-Bench Pro — выше, чем у GPT-5.5 (58,6%)
×4реже пропускает дефекты кода незамеченными, чем Opus 4.7
1 млнтокенов контекста, вывод до 128 000
28.05дата выхода — через 41 день после Opus 4.7
Что нового

Шесть изменений, которые заметны в работе

Не косметика, а поведение: как модель распределяет усилия, как признаёт ошибки и как берётся за задачи, которые раньше приходилось дробить вручную.

Dynamic Workflows

Инструмент в режиме предпросмотра: модель разворачивает сотни параллельных саб-агентов на одну большую задачу и сводит результат воедино.

Контроль усилия

Три уровня — normal, extra, max. Простую задачу можно решить быстрее, сложное ревью — прогнать с максимальной тщательностью.

System entries

В Messages API инструкции теперь можно обновлять частями, не сбрасывая кэш целиком, — быстрее и дешевле для агентных пайплайнов.

Честность как приоритет

По тестам Anthropic модель реже делает недоказанные утверждения и чаще прямо говорит «не знаю», вместо того чтобы правдоподобно выдумывать.

Реже нарушает инструкции

В тестировании Anthropic снижена доля случаев обхода ограничений и несоблюдения инструкций по сравнению с предыдущей моделью.

Legal Agent Benchmark

Первая модель, преодолевшая порог 10% на этом бенчмарке юридических агентных задач — раньше все результаты были ниже.

Цифры, а не общие слова

Бенчмарки — включая те, где Opus проигрывает

Публичные результаты по независимым и внутренним тестам Anthropic. Два бенчмарка ниже показывают проигрыш GPT-5.5 — мы не стали их убирать.

69,2%
SWE-Bench Pro — комплексные задачи инженерии
GPT-5.5: 58,6%
74,6%
Terminal-Bench 2.1 — работа в терминале
Opus 4.7: 66,1% · GPT-5.5: 83,4% — здесь Opus проигрывает
57,9%
OSWorld-Verified — управление интерфейсом ОС
Opus 4.7: 54,7%
1890
GDPval-AA — качество работы уровня специалиста
Gemini 3.1 Pro: 1314
49,8%
Humanity's Last Exam — экспертные вопросы на грани знаний
Opus 4.7: 46,9% · GPT-5.5: ≈58% — здесь Opus тоже позади
53,9%
Finance Agent v2 — финансовые агентные задачи
Opus 4.7: 51,5%

Отдельно стоит Super-Agent: по данным обзора vc.ru, Opus 4.8 — единственная из протестированных моделей, завершившая каждый кейс от начала до конца. Профильные разборы (vc.ru) называют апдейт «скромным, но ощутимым улучшением» — не поколенческим скачком, а заметным ростом надёжности на прежней базе.

Главная тема страницы

Почему «реже пропускает» — не маркетинговая фраза

Четыре конкретных поведенческих изменения, зафиксированных Anthropic и партнёрами в тестировании — из них и собран герой этой страницы.

01

Флагует, а не молчит

Примерно в 4 раза реже, чем Opus 4.7, модель пропускает дефекты кода незамеченными — по внутренним тестам Anthropic на задачах ревью.

02

Говорит «я не знаю»

В тестировании модель чаще прямо признаёт неуверенность в своей работе и реже делает недоказанные утверждения, чем предшествующие версии.

03

Реже нарушает инструкции

Зафиксировано снижение доли случаев обманчивого поведения и несоблюдения инструкций по сравнению с Opus 4.7 в тестах безопасности Anthropic.

04

Замечено партнёрами

Bridgewater Associates, тестировавшая модель, отметила её склонность проактивно сообщать о проблемах во входных и выходных данных — а не проходить мимо них.

Новый инструмент · предпросмотр

Dynamic Workflows: сотни саб-агентов на одну задачу

Каждый квадрат ниже — условный саб-агент, которому Opus 4.8 может делегировать часть крупной задачи и свести результат обратно.

Цитата Anthropic: «Claude Code вместе с Opus 4.8 теперь способен проводить миграции кодовой базы на сотни тысяч строк от старта до слияния, ориентируясь на существующий набор тестов как на критерий готовности».
Кому подойдёт

Три сценария, где Opus 4.8 на своём месте

Разработчикам

Ревью и миграции

Код-ревью перед мержем, крупные миграции через Dynamic Workflows, CI-гейты, где важно не пропустить дефект, а не ответить на долю секунды быстрее.

Юристам и аналитикам

Аудит и документы

Первая модель, преодолевшая порог 10% на Legal Agent Benchmark. Разбор договоров, финансовые агентные задачи, где нужна честная оценка рисков.

Уже на Sonnet 5 или Fable 5

Точка эскалации

Opus 4.8 хорошо встаёт рядом: как модель для точечного глубокого ревью там, где Sonnet 5 работает на потоке. Кстати, именно на неё переводится часть чувствительных запросов Fable 5 — по кибербезопасности и биологии.

Сравнение трёх моделей ↓
Бесплатно

Claude Opus 4.8 можно попробовать совершенно бесплатно

Не нужно сразу оформлять подписку, чтобы понять, подходит ли модель под вашу задачу — проверьте её на своём коде или документе прямо после регистрации.

Пробный объём при регистрацииСразу после регистрации на Strelka AI открывается пробный доступ к Opus 4.8 — можно проверить модель на своей задаче, ничего не оплачивая заранее.
Без VPN и зарубежной картыРегистрация занимает пару минут: почта и российская карта. Иностранный номер, VPN и зарубежный аккаунт не нужны.
Один вход на 50+ моделейОдна подписка открывает Opus 4.8 и остальные нейросети платформы — переключаться между ними можно в любой момент, без отдельной регистрации.
Переключайтесь в любой моментНе подошла одна модель — тот же запрос можно тут же отправить в Sonnet 5 или Fable 5 и сравнить результат.
Честно

Что учесть перед тем, как переходить на неё

Пять вещей, о которых лучше знать заранее, чем выяснить на второй неделе использования.

Контекст не вырос

Контекстное окно осталось на уровне предшественницы — 1 млн токенов. Если для вашей задачи важен именно рост контекста, в этом поколении его не случилось.

Проигрывает по двум бенчмаркам

На Terminal-Bench 2.1 модель уступает GPT-5.5: 74,6% против 83,4%. На Humanity's Last Exam разрыв ещё заметнее — 49,8% против примерно 58%. Мы не стали прятать эти цифры в разделе бенчмарков.

Улучшение скромное, а не революционное

Профильные обзоры (в частности vc.ru) описывают Opus 4.8 как ощутимый, но не поколенческий шаг вперёд по сравнению с Opus 4.7 — это заметная прибавка в надёжности, а не смена архитектуры.

Лишняя строгость может ощущаться как трение

Модель, склонная помечать неопределённость и переспрашивать, на очень простых задачах иногда выдаёт больше оговорок, чем нужно, — это обратная сторона повышенной честности.

Dynamic Workflows — режим предпросмотра

Инструмент параллельных саб-агентов пока в статусе research preview у Anthropic: поведение и доступность могут измениться в следующих обновлениях.

Готовые формулировки

Промпты, с которых удобно начать

Ревью кода

Проверь этот код так, будто от твоей проверки зависит прод. Отдельно перечисли места, где ты не уверен, что понял логику правильно, — не пропускай их молчанием, а явно пометь как требующие взгляда человека.

Крупная миграция

Цель: перевести проект на новую версию библиотеки. Прочитай кодовую базу целиком, составь план по этапам с оценкой риска и держи существующий набор тестов зелёным на каждом шаге. В конце — отчёт и список мест для ревью человеком.

Аудит документа

Прикладываю договор. Проверь внутреннюю непротиворечивость условий, отметь формулировки, которые можно трактовать двояко, и честно укажи, где тебе не хватает контекста для однозначного вывода.

Честная самопроверка

Реши задачу, а затем перечитай собственный ответ так, будто ты — придирчивый ревьюер чужой работы. Отдельным списком выпиши всё, в чём ты не до конца уверен, и почему.

Спецификация

Характеристики

Данные на 15 сентября 2026 года.

Идентификатор в API
claude-opus-4-8
Разработчик
Anthropic
Дата выхода
28 мая 2026
Контекстное окно
1 000 000 токенов
Максимальный ответ
128 000 токенов
Знания до
январь 2026
Контроль усилия
normal / extra / max
Fast Mode
до 2,5× быстрее на части задач
Dynamic Workflows
предпросмотр, параллельные саб-агенты
System entries
обновление инструкций без сброса кэша
Инструменты
исполнение кода, программные вызовы инструментов
Доступ из России
напрямую через Strelka AI, без VPN
Выбор модели

Opus 4.8, Sonnet 5 или Fable 5

Три модели Claude на Strelka AI решают разные задачи — вот короткая карта различий.

Claude Opus 4.8

  • Ревью кода, аудит, агентные задачи
  • ×4 реже пропускает дефекты незамеченными
  • Dynamic Workflows — сотни саб-агентов
  • Контроль усилия: normal / extra / max
Эта страница

Claude Sonnet 5

  • Тысячи однотипных запросов в день
  • Быстрый отклик, повседневный код
  • Чат-боты, поддержка, модерация
  • Агенты на минуты, а не на сутки
Страница Sonnet 5 →

Claude Fable 5

  • Класс Mythos, задачи на часы и дни
  • Крупные миграции и глубокая аналитика
  • Часть чувствительных сессий уходит на Opus 4.8
  • Лучшее зрение в линейке Claude
Страница Fable 5 →
Частые вопросы

Вопросы про Claude Opus 4.8

01Что такое Claude Opus 4.8
Флагманская модель Anthropic, вышедшая 28 мая 2026 года, через 41 день после Opus 4.7. Она заметно надёжнее в ревью кода и агентных задачах: реже пропускает дефекты незамеченными и чаще прямо говорит о своей неуверенности вместо правдоподобной выдумки.
02Когда вышла Claude Opus 4.8
28 мая 2026 года, идентификатор в API — claude-opus-4-8. Знания модели ограничены январём 2026 года.
03Чем Opus 4.8 отличается от Opus 4.7
Главное отличие — не скорость, а надёжность: модель примерно в 4 раза реже пропускает дефекты в коде незамеченными, чаще предупреждает о неуверенности и реже нарушает инструкции в тестах Anthropic. На бенчмарках прирост заметный, но не революционный: OSWorld-Verified 57,9% против 54,7%, Finance Agent v2 53,9% против 51,5%. Появился и новый инструмент — Dynamic Workflows.
04Что такое Dynamic Workflows
Инструмент в режиме предпросмотра, который позволяет Opus 4.8 разворачивать сотни параллельных саб-агентов для одной большой задачи. Anthropic приводит пример: Claude Code вместе с Opus 4.8 может провести миграцию кодовой базы на сотни тысяч строк от старта до слияния, ориентируясь на существующий набор тестов как на критерий готовности.
05Правда ли что модель реже ошибается в коде
По данным Anthropic, Opus 4.8 примерно в 4 раза реже, чем предшествующая модель, пропускает дефекты кода незамеченными. В тестировании компании модель также реже делает недоказанные утверждения и реже отклоняется от инструкций. Это не означает отсутствие ошибок — это означает, что подозрительные места она склонна помечать, а не замалчивать.
06Какой контекст у Claude Opus 4.8
1 000 000 токенов — столько же, сколько у предшественницы Opus 4.7, контекстное окно в этом поколении не увеличивали. Максимальный ответ — 128 000 токенов.
07Чем Opus 4.8 отличается от Claude Sonnet 5 и Fable 5
Sonnet 5 — рабочая лошадка для потока однотипных запросов, Fable 5 — модель класса Mythos для многодневных автономных задач. Opus 4.8 — между ними: модель для ревью, аудита и агентных сценариев, где важнее не ошибиться, чем ответить быстрее всех. Кстати, именно на Opus 4.8 переводится часть чувствительных запросов Fable 5 — по кибербезопасности и биологии, менее 5% сессий.
08Есть ли у модели слабые места
Да. Контекст не вырос — 1 млн токенов, как и у предшественницы. На Terminal-Bench 2.1 модель уступает GPT-5.5: 74,6% против 83,4%. На Humanity's Last Exam разрыв ещё заметнее: 49,8% против примерно 58%. Профильные обзоры называют улучшение скромным, но реальным, а не поколенческим скачком. Dynamic Workflows пока в статусе предпросмотра и может измениться.
09Можно ли попробовать Claude Opus 4.8 бесплатно
Да. При регистрации в Strelka AI открывается пробный доступ — можно проверить Opus 4.8 на своей задаче до оформления подписки. Карта нужна российская, VPN и зарубежный аккаунт не требуются. Подписка одна на все 50+ моделей платформы.
10Нужен ли VPN для доступа к Claude Opus 4.8
Нет. Strelka AI открывает Claude Opus 4.8 напрямую из России, без VPN и зарубежной карты — регистрация российской картой, интерфейс на русском.
11Что такое effort control (контроль усилия)
Параметр, который задаёт, сколько вычислительных усилий модель тратит на ответ: normal, extra или max. На простой задаче можно сэкономить время, выбрав normal, а на сложном ревью или аналитике — включить max, чтобы модель проверяла себя тщательнее.
12Как получить доступ к Claude Opus 4.8 прямо сейчас
Зарегистрируйтесь на Strelka AI и откройте Claude Opus 4.8 в каталоге моделей — пробный доступ включается сразу после регистрации, без VPN и лишних аккаунтов.

Попробуйте модель, которая помечает, а не молчит

Claude Opus 4.8 и ещё 50+ нейросетей — в одной подписке Strelka AI. Пробный доступ бесплатно, без VPN и зарубежной карты.

На чём основан разбор

Источники

Официальный анонс и факты о Dynamic Workflows, effort control и честности модели — по материалам Anthropic. Бенчмарки и сравнение с GPT-5.5 — по разбору vc.ru. Дополнительный контекст о выходе модели — по материалам TechCrunch и Help Net Security. Практические сценарии использования — по обзору Habr.