Каталог О нас Тарифы Реквизиты Соглашение Что нового Бенчмарки Вопросы
Anthropic · 28 сентября 2026

Claude Sonnet 5.5
почти Opus, на скорости Sonnet

Огромный скачок в агентных и кодовых бенчмарках — Terminal-Bench вырос с 10,3% до 70,6% — при этом модель примерно на 30% быстрее предыдущей версии и расходует меньше токенов на типовую задачу. По части бенчмарков Sonnet 5.5 почти догнала Claude Opus 5.5.

+60,3 п.п.Terminal-Bench 4.0 к Sonnet 5
30%+быстрее Sonnet 5
1Mтокенов контекста
Схематично · Terminal-Bench 4.0, Sonnet 5 → Sonnet 5.5
Sonnet 5 · 10,3%Sonnet 5.5 · 70,6%

Условная схема роста: высота столбцов иллюстрирует разрыв между версиями на Terminal-Bench 4.0, а не абсолютный масштаб. Пунктир сверху — уровень Opus 5.5 (66,4%), который Sonnet 5.5 на этом тесте уже превосходит.

01 Коротко

Спецификация Claude Sonnet 5.5

Разработчик
Anthropic
Релиз
28 сентября 2026
ID модели
claude-sonnet-5-5
Предыдущая версия
Claude Sonnet 5 (30 июня 2026)
Контекст
1 000 000 токенов
Максимальный ответ
128 000 токенов (300 000 через Batch API, бета)
Знания
До июня 2026
Режим мышления
Адаптивный — high по умолчанию в API, medium в приложениях и Claude Code
Модальности
Текст и изображения на входе, текст на выходе
Доступность
Claude-приложения, API, AWS Bedrock, Google Cloud, Microsoft Foundry, Claude Code, GitHub Copilot, Cursor
02 Возможности

Что нового в Claude Sonnet 5.5

По данным независимых обзоров модели — шесть моментов, которые определяют обновление.

↑

Резкий скачок в агентных задачах

Terminal-Bench 4.0: 10,3% → 70,6%. OSWorld 2.1: 57,0% → 80,1%. CursorBench 4.0: 34,1% → 55,5%.

⚡

Быстрее и экономнее

Более чем на 30% быстрее Sonnet 5 и расходует меньше токенов на типовую задачу — по данным независимых тестов.

◎

Почти вплотную к Opus 5.5

На части бенчмарков разрыв с Opus 5.5 — единицы пунктов, а на Terminal-Bench 4.0 Sonnet 5.5 даже впереди.

⛨

Account-Bound Thinking

Блоки размышлений работают только в аккаунте, где созданы — защита от дистилляции модели через смену аккаунта.

🛡

Кибербезопасные ограничения

Впервые для модели класса Sonnet применён полный набор мер кибербезопасности Anthropic.

⧉

Кэш полезен и для коротких запросов

Минимальный порог кэширования снижен с 1024 до 512 токенов — кэш начинает работать раньше.

03 Цифры

Claude Sonnet 5.5 против Claude Sonnet 5

Честно: цифры собраны из независимых обзоров и агрегаторов бенчмарков, а не только из материалов Anthropic. Рост почти по всем направлениям заметный, местами — кратный.

Terminal-Bench 4.0
10,3 → 70,6
OSWorld 2.1
57,0 → 80,1
CursorBench 4.0
34,1 → 55,5
SWE-Bench Pro
63,2 → 81,3
GDPval-AA v2.1
1449 → 1844
FrontierCode 1.1
42,4 → 46,2

Первое значение в каждой строке — Sonnet 5, второе (выделено) — Sonnet 5.5. Самый резкий рост — на Terminal-Bench 4.0 (+60,3 п.п.), самый скромный — на FrontierCode 1.1 (+3,8 п.п.).

04 Контекст в линейке

Насколько Sonnet 5.5 близок к Opus 5.5

На части бенчмарков разрыв между Sonnet 5.5 и флагманской Opus 5.5 — единицы пунктов. На части — Anthropic прямо говорит, что Opus 5.5 остаётся заметно сильнее.

Цитата Anthropic: «Opus 5.5 остаётся заметно сильнее в сложных, открытых задачах, требующих устойчивого суждения».
Terminal-Bench 4.0
Opus 66,4 → 70,6
GDPval-AA v2.1
Opus 1846 → 1844
OSWorld 2.1
Opus 81,8 → 80,1
CursorBench 4.0
Opus 57,8 → 55,5
FrontierCode 1.1
Opus 54,4 → 46,2
Humanity's Last Exam
Opus 67,7 → 64,5

Первое значение — Opus 5.5, второе (выделено) — Sonnet 5.5. На Terminal-Bench 4.0 Sonnet 5.5 обходит Opus 5.5; на FrontierCode 1.1 и Humanity's Last Exam разрыв заметнее — это не полный паритет по всем задачам.

05 Применение

Для чего в первую очередь нужен Sonnet 5.5

Anthropic описывает модель как «лучшее сочетание скорости и интеллекта» — для объёма повседневных задач, а не для многочасовых автономных сессий.

✎

Хорошо очерченные задачи

Чёткое ТЗ, понятный объём работы — область, где модель наиболее предсказуема и быстра.

⚑

Исправление багов

Терминальные и агентные бенчмарки выросли сильнее всего — это напрямую работа с кодом и отладкой.

▤

Аккуратные документы

Подготовка текстов, отчётов и писем — там, где важны скорость и предсказуемый результат, а не долгое рассуждение.

⇄

Высокий объём запросов

Модель быстрее и расходует меньше токенов на задачу — удобно для частых, повторяющихся обращений.

06 Быстрый старт

Как начать за 3 шага

1
Зарегистрируйтесь

Без VPN, из России — вход и оплата российской картой.

2
Откройте Claude Sonnet 5.5

Модель доступна в общем каталоге Strelka AI — без настройки SDK и отдельного биллинга у Anthropic.

3
Ставьте повседневные задачи

Код, документы, объёмные обращения — там, где важны скорость и предсказуемый результат.

07 Честно

Чем отличается от других моделей на Strelka AI

Claude Sonnet 5.5 — скорость и объём, почти Opus-уровень на части задач
Claude Opus 5.5 — флагман, сильнее в сложных открытых задачах · страница модели
Claude Fable 5.1 — класс Mythos, часы и дни автономной работы · страница модели
Claude Sonnet 5 — предыдущая версия · страница модели

Чего мы пока не знаем или не подтверждаем

  • Все цифры собраны из независимых обзоров и агрегаторов бенчмарков, а не из единого официального источника — возможны расхождения в методологии между тестами.
  • По данным Artificial Analysis, у Sonnet 5.5 ниже точность фактологических ответов, чем у Opus 5.5 (54% против 66%), и модель реже признаёт собственную неуверенность, когда не знает ответа.
  • На FrontierCode 1.1 и Humanity's Last Exam разрыв с Opus 5.5 заметнее, чем на других бенчмарках — это не полный паритет по всем задачам.
  • Параметр thinking: disabled для отключения мышления больше не работает — нужно использовать between_tools; это ломает часть старых интеграций.
  • Принудительный выбор инструмента (tool_choice: any или tool) теперь возвращает ошибку.
  • Блоки размышлений привязаны к модели и конкретному диалогу — редактирование истории переписки вызывает ошибку 400.
  • Старая версия инструмента работы с компьютером не принимается на Claude API и Google Cloud — нужна актуальная версия инструмента.
  • По некоторым данным, более рискованные задачи в области кибербезопасности заметно чаще переключаются на предыдущую версию, Sonnet 5, а не обрабатываются самой Sonnet 5.5.
  • Модель выпущена недавно (28 сентября 2026) — часть деталей у провайдеров ещё может уточняться.
08 Вопросы

Частые вопросы о Claude Sonnet 5.5

Что такое Claude Sonnet 5.5?
Модель от Anthropic, выпущенная 28 сентября 2026 года — обновление Claude Sonnet 5. По данным независимых обзоров, в агентных и кодовых бенчмарках Sonnet 5.5 совершает огромный скачок и подбирается почти вплотную к Claude Opus 5.5, оставаясь при этом быстрее и экономнее по токенам.
Чем Sonnet 5.5 отличается от Sonnet 5?
Главное отличие — резкий рост в агентных задачах: Terminal-Bench 4.0 вырос с 10,3% до 70,6%, CursorBench 4.0 — с 34,1% до 55,5%, OSWorld 2.1 — с 57,0% до 80,1%. Модель также примерно на 30% быстрее предыдущей версии и расходует меньше токенов на типовую задачу. Знания обновлены до июня 2026 года (у Sonnet 5 — январь 2026).
Насколько Sonnet 5.5 близок к Opus 5.5?
По опубликованным бенчмаркам — очень близко: GDPval-AA v2.1 у Sonnet 5.5 составляет 1844 против 1846 у Opus 5.5, OSWorld 2.1 — 80,1% против 81,8%. На Terminal-Bench 4.0 Sonnet 5.5 даже немного опережает Opus 5.5 (70,6% против 66,4%). При этом сама Anthropic отмечает, что Opus 5.5 остаётся заметно сильнее в сложных, открытых задачах, требующих устойчивого суждения — например, на FrontierCode 1.1 и Humanity's Last Exam Sonnet 5.5 заметно уступает.
Что такое Account-Bound Thinking?
Защитный механизм: блоки размышлений модели работают только в том аккаунте, где они были созданы. Это должно затруднять попытки дистилляции модели через смену аккаунта между запросами.
Какой контекст у Claude Sonnet 5.5?
1 млн токенов контекста, до 128 000 токенов в обычном ответе и до 300 000 токенов через Batch API (бета). Минимальный порог кэширования запроса снижен до 512 токенов — это делает кэш полезным и для более коротких запросов.
Есть ли в Sonnet 5.5 breaking changes для разработчиков?
Да, несколько. Параметр отключения мышления через thinking: disabled больше не работает — нужно использовать between_tools. Принудительный выбор инструмента (tool_choice: any или tool) теперь возвращает ошибку. Блоки размышлений привязаны к модели и конкретному диалогу — редактирование истории переписки вызывает ошибку 400. Старая версия инструмента работы с компьютером на Claude API и Google Cloud больше не принимается.
В чём Sonnet 5.5 уступает Opus 5.5?
По данным независимых обзоров: ниже точность фактологических ответов (54% против 66% у Opus по данным Artificial Analysis), чаще не признаёт собственную неуверенность, когда не знает ответа. На FrontierCode 1.1 и Humanity's Last Exam разрыв с Opus 5.5 заметнее, чем на других бенчмарках. Сама Anthropic прямо называет Opus 5.5 более сильной моделью для сложных открытых задач, требующих устойчивого суждения.
Для каких задач подходит Claude Sonnet 5.5?
Anthropic позиционирует модель как «лучшее сочетание скорости и интеллекта» — для хорошо очерченных повседневных задач, исправления багов и подготовки аккуратных документов. Это модель для объёма и быстрого отклика, а не для многочасовых автономных сессий — для них в каталоге Strelka AI есть Claude Fable 5.1.
Данные бенчмарков Sonnet 5.5 проверены независимо?
Цифры на странице собраны из независимых обзоров и агрегаторов бенчмарков (см. раздел «Источники»), а не только из материалов Anthropic. Это снижает риск однобокой картины, но не заменяет полноценную независимую верификацию.
Нужен ли VPN для доступа к Claude Sonnet 5.5 в Strelka AI?
Нет, Strelka AI работает из России без VPN и прокси, оплата — российскими картами.
Источники: CellCog, CoderSera, The AI Career Lab. Данные сверены на 01.10.2026.

Попробуйте Claude Sonnet 5.5 бесплатно

Без VPN, без отдельного биллинга у Anthropic — вход и оплата российской картой в Strelka AI.