Anthropic представила Claude Sonnet 5.5 . Новая модель сохранила тарифы Sonnet 5, но, по измерениям компании, генерирует ответ более чем на 30% быстрее и расходует меньше токенов при выполнении задач. В Terminal-Bench 4.0 её результат вырос с 10,3% до 70,6%, а в тестах интеллектуальной работы Sonnet 5.5 приблизилась к старшей Claude Opus 5.5. Модель доступна в Claude, Claude Code и через API под идентификатором claude-sonnet-5-5.

Результаты Sonnet 5.5 в восьми испытаниях
В опубликованной Anthropic таблице Sonnet 5.5 опережает Sonnet 5 во всех восьми испытаниях. На GDPval-AA v2.1, где оцениваются рабочие задачи из разных профессий, она получила 1844 рейтинговых пункта против 1846 у Opus 5.5. Старшая модель сохранила преимущество в CursorBench, Humanity's Last Exam, OSWorld и Chartography. Баллы относятся к отдельным методикам и не образуют общего рейтинга моделей.
| Испытание | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0, агентное программирование | 70,6% | 10,3% | 66,4% (xhigh) | – |
| FrontierCode 1.1 (Main), агентное программирование | 52,1% (xhigh) 46,2% (max) | 42,4% | 54,4% | 49,3% |
| CursorBench 4.0, агентное программирование | 55,5% | 34,1% | 57,8% | – |
| GDPval-AA v2.1, рейтинг рабочих задач | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1, рейтинг продолжительных рабочих задач | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam, с инструментами | 64,5% | 54,9% | 67,7% | – |
| OSWorld 2.1, частичный зачёт | 80,1% | 57,0% | 81,8% | – |
| Chartography, распознавание графиков без инструментов | 61,6% | 15,6% | 64,4% | 53,6% |
На Terminal-Bench 4.0 агент выполняет многоэтапные задачи в командной строке. Sonnet 5.5 набрала 70,6% против 10,3% у предшественницы; результат Opus 5.5 в этой строке получен при уровне усилий xhigh. Публичного показателя GPT-6 Sol для Terminal-Bench 4.0 нет. Поэтому на отдельном графике соотношения результата и стоимости Anthropic показывает GPT-5.6 Sol, хотя в других строках таблицы присутствует GPT-6 Sol.

Строка FrontierCode требует отдельного пояснения. Sonnet 5.5 получила 52,1% при уровне усилий xhigh, но 46,2% при более высоком max. По объяснению Anthropic, на max модель чаще запускала дополнительную проверку кода: в двух изученных случаях это привело к превышению времени или лишним изменениям, которые методика теста штрафует. Для GPT-6 Sol в этой строке указано 49,3%.
Уровень усилий – настройка глубины обработки запроса моделью. Его повышение обычно увеличивает время работы и расход токенов, но не гарантирует лучший результат в каждом испытании.
Результаты GDPval-AA v2.1 и AA-Briefcase v1.1 для Sonnet 5.5 организация Artificial Analysis получила на предварительной версии модели. Позднее Anthropic исправила ошибку, которая могла ухудшать ответы со структурированным выводом. Компания также предупреждает, что приведённые показатели GPT-6 Sol в этих двух испытаниях и Chartography могли ещё не учитывать исправление ошибки распознавания изображений у модели OpenAI. Эти оговорки особенно существенны при сравнении близких результатов.
Цена токенов осталась прежней
Claude Sonnet 5.5 стоит 2 $ за миллион входных и 10 $ за миллион выходных токенов в Claude API. Запись миллиона токенов в пятиминутный кэш стоит 2,50 $, чтение из кэша – 0,20 $. Базовые тарифы совпадают с Sonnet 5. При этом Anthropic оценивает стоимость выполнения отдельных задач на новой модели до 30% ниже: по её измерениям, для результата требуется меньше токенов.
Чтение из кэша – повторное использование сохранённой части запроса, которая оплачивается отдельно от обычного входа. Для Sonnet 5.5 минимальная длина запроса, который можно поместить в кэш, составляет 512 токенов.
Anthropic также заявляет, что Sonnet 5.5 генерирует ответ более чем на 30% быстрее Sonnet 5. Скорость и экономия измерены компанией на её нагрузках: стоимость конкретной задачи зависит от объёма запросов и ответов, числа вызовов инструментов и выбранного уровня усилий. В приложениях Claude и Claude Code по умолчанию установлен уровень medium, а в Claude API – high.
Доступность и условия перехода с Sonnet 5
Контекстное окно Sonnet 5.5 составляет 1 млн токенов, обычный предел вывода – 128 000 токенов. Согласно официальной карточке модели, она доступна через Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. Идентификатор для Claude API – claude-sonnet-5-5, для Amazon Bedrock – anthropic.claude-sonnet-5-5.
Разработчикам действующих интеграций нужно проверить параметры запросов перед заменой модели. В руководстве по переходу Anthropic указывает, что Sonnet 5.5 отклоняет принудительный вызов инструмента через значения any и tool параметра tool_choice. Прежний способ отключить рассуждения с помощью disabled тоже возвращает ошибку. Вместо него предусмотрен режим between_tools, который работает при уровнях усилий low, medium и high.
При управлении компьютером через Claude API или Google Cloud требуется набор инструментов computer_toolset_20260801 вместо computer_20251124. В Amazon Bedrock прежний computer_20251124 сохраняется. Кроме того, часть сообщений между вызовами инструментов теперь поступает в блоках thinking. Приложению, которое показывает пользователю ход продолжительной задачи, может потребоваться изменить обработку таких блоков.
Anthropic ввела для Sonnet 5.5 дополнительные ограничения на запросы повышенного риска в сфере кибербезопасности; обычная разработка и исправление ошибок, по заявлению компании, остаются доступными. Следующую модель семейства, Claude Haiku 5.5, компания планирует выпустить в ближайшие недели, но точную дату пока не назвала.