Anthropic представила Claude Opus 5.5: дешевле Opus 5 на 40%

101 комментарии
Claude Opus 5.5 вышла 22 сентября 2026 года. ИИ-модель получила контекст на 1 млн токенов, вывод до 128 000 токенов и уровень усилий medium по умолчанию. API стоит 4 $ за миллион входных и 20 $ за миллион выходных токенов, чтение из кэша подешевело до 0,20 $, а скорость вывода выросла более чем на 30%

Anthropic представила Claude Opus 5.5 – первую модель нового семейства Claude 5.5. Компания оценивает стоимость типичной нагрузки примерно на 40% ниже, чем у Opus 5, и заявляет об увеличении скорости вывода более чем на 30%. Контекстное окно составляет 1 млн токенов, максимальный объём обычного ответа – 128 000 токенов. Модель вышла и уже доступна в платных тарифах Claude, Claude Code, API и облачных платформах.

comss img 2026 09 22 202143

Вход и вывод подешевели на 20%, чтение из кэша – на 60%

Стандартные тарифы API для Claude Opus 5.5 составляют 4 $ за миллион входных и 20 $ за миллион выходных токенов. У предыдущей Claude Opus 5 те же операции стоят 5 и 25 $ соответственно. Запись в пятиминутный кэш подешевела с 6,25 до 5 $, а чтение – с 0,50 до 0,20 $ за миллион токенов.

Операция, за 1 млн токеновClaude Opus 5.5Claude Opus 5Изменение
Обычный вход4 $5 $&񗥂20%
Вывод20 $25 $&񗥂20%
Запись в кэш на 5 минут5 $6,25 $&񗥂20%
Запись в кэш на 1 час8 $10 $&񗥂20%
Чтение из кэша0,20 $0,50 $&񗥂60%

Разница особенно заметна в продолжительных сессиях Claude Code, где модель при каждом ходе получает значительную часть накопленного контекста повторно. В примере Anthropic с 2 млн кэшированных входных токенов, 200 000 новых входных и 60 000 выходных токенов одинаковая сессия стоит 2,40 $ на Opus 5.5 вместо 3,50 $ на Opus 5. Экономия только за счёт новых тарифов составляет около 31%; заявленные 40% для типичной нагрузки дополнительно предполагают, что новой модели требуется меньше ходов и токенов.

Чтение из кэша – повторная подача модели уже обработанного и сохранённого начала запроса. Для Opus 5.5 такие токены стоят 5% обычной цены входа, но кэш срабатывает только для неизменившейся части контекста.

Отдельный Быстрый режим (Fast mode) работает, по данным компании, до 2,5 раза быстрее стандартного. Его тарифы составляют 8 $ за миллион входных и 40 $ за миллион выходных токенов.

Уровень усилий medium включён по умолчанию


comss img 2026 09 22 202329

Claude Opus 5.5 использует адаптивное рассуждение, которое нельзя полностью отключить. Управлять глубиной обработки запроса предлагается через уровни усилий low, medium, high, xhigh и max. Значение по умолчанию изменилось с high у Opus 5 на medium у Opus 5.5.

Уровень усилий – настройка, влияющая на объём рассуждения, текстового ответа и вызовов инструментов. Низкие значения сокращают расход токенов и задержку, высокие рассчитаны на сложные и продолжительные задачи.

Для повседневной работы Anthropic рекомендует начинать с medium. Low предназначен для простых операций и вспомогательных агентов, high – для сложного программирования и анализа, а xhigh и max – для продолжительных задач, где качество важнее расхода токенов.

Согласно официальной карточке модели, контекстное окно достигает 1 млн токенов, обычный предел вывода – 128 000 токенов, а экспериментальный Batch API допускает до 300 000 токенов вывода. Надёжная граница знаний и дата окончания обучающих данных указаны как июнь 2026 года. Идентификатор в Claude API – claude-opus-5-5.

Opus 5.5 опередила Opus 5 в шести выбранных тестах

comss img 2026 09 22 202210

В опубликованной Anthropic сводке Opus 5.5 опережает Opus 5 во всех перечисленных ниже испытаниях. Она получила лучший результат в четырёх строках из шести, тогда как GPT-6 Astra сохранила первое место в AutomationBench и Terminal-Bench-Science 0.1.

ТестOpus 5.5Fable 5.1Opus 5GPT-6 AstraGPT-5.6 Sol
Terminal-Bench 4.066,4%55,8%52,3%57,9%37,3%
FrontierCode v1.1, Main54,4%50,3%48,0%53,3%47,5%
CursorBench 4.057,8%51,8%46,6%41,7%
GDPval-AA v2.1, Elo18461735170815421588
AutomationBench40,0%31,4%26,9%41,4%28,8%
Terminal-Bench-Science 0.158,7%52,6%29,0%64,6%22,4%

Почти все результаты Opus 5.5 в общей таблице получены с адаптивным рассуждением и уровнем max. Исключение – Terminal-Bench 4.0, где использовался xhigh; показатель GPT-6 Astra в этом испытании относится к high. Стандартная ошибка для Opus 5.5 в Terminal-Bench 4.0 составляет ±2,6 процентного пункта, а в Terminal-Bench-Science 0.1 погрешность разных моделей находится в диапазоне ±3,5–5 пунктов.

Anthropic отдельно предупреждает, что небольшие различия в тестах всё хуже передают практическую разницу между моделями. Компания описывает Opus 5.5 как сопоставимую с Claude Fable 5.1 на большинстве рабочих задач, хотя результаты зависят от уровня усилий, инструментария и конкретного набора заданий.

Переход с Opus 5 требует проверки интеграции

Снижения тарифов недостаточно для автоматического перевода действующих приложений. В руководстве по миграции Anthropic перечисляет несколько несовместимых изменений:

  • адаптивное рассуждение нельзя отключить или заменить прежним фиксированным бюджетом токенов;
  • принудительные режимы tool_choice со значениями any и tool возвращают ошибку; вместо них требуется auto со строгой проверкой инструментов или структурированным выводом;
  • блоки рассуждения связаны с конкретной моделью и историей разговора, поэтому ранее переданный контекст нельзя произвольно редактировать;
  • в Claude API и Google Cloud прежний инструмент computer_20251124 заменён набором computer_toolset_20260801; в Amazon Bedrock старый вариант пока сохраняется.

Изменилась и структура промежуточных сообщений между вызовами инструментов. Текст о ходе работы теперь возвращается в блоках thinking и по умолчанию скрыт. Интерфейс, который показывал пользователю такие сообщения, необходимо перенастроить, иначе во время продолжительных операций он может выглядеть бездействующим.

Доступ открыт в Claude, API и облачных платформах

Opus 5.5 доступна подписчикам Claude Pro, Max, Team и Enterprise, а также в Claude Code. Anthropic одновременно увеличила пятитчасовые лимиты использования на тарифах Pro, Max и Team и добавила сохраняемый сброс ограничения, который пользователь может применить позднее.

Разработчики могут подключить модель через Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud и Microsoft Foundry. Anthropic присвоила ей статус Active и обязуется не выводить модель из эксплуатации раньше .

Защитные ограничения приблизились к Fable 5.1

Opus 5.5 стала первой моделью семейства Opus с защитными механизмами того же класса, что у Fable 5.1. Обычная разработка и исправление ошибок разрешены, но многие специализированные задачи кибербезопасности автоматически перенаправляются на Opus 4.8. Расширенный доступ Anthropic планирует выдавать проверенным специалистам через Cyber Verification Program.

Похожие ограничения действуют для исследований в области биологии. Организации, которым они мешают выполнять законную научную работу, могут подать заявку в Life Sciences Verification Program. В API также применяется защита preserved thinking, мешающая изменять предыдущий контекст ради извлечения скрытых рассуждений модели.

Сравнивать нужно стоимость завершённой задачи

Снижение цены токена не гарантирует одинаковой экономии для любой нагрузки. На итог влияют число ходов, доля кэшированного контекста, объём ответа, уровень усилий и повторные попытки после неудачного результата. В продолжительных проектах Claude Code с параллельными потоками особенно важны стоимость чтения из кэша и модель, назначенная каждому потоку.

Для практического сравнения Anthropic советует выполнить несколько реальных задач на Opus 5 и Opus 5.5, а затем сопоставить в отчёте /usage число ходов, входные и выходные токены, долю кэшированных данных и общую стоимость. Это позволит отделить гарантированное снижение тарифов на 20–60% от экономии, которая зависит от поведения модели в конкретном проекте.

Автор:
Комментарии и отзывы

Нашли ошибку?

Новое на сайте