23 сентября 2026 г.
Claude Opus 5.5: флагман на 40% дешевле и на 30% быстрее

Anthropic выпустила Claude Opus 5.5 - первую модель семейства 5.5. Главное в двух цифрах: на типовых задачах она обходится примерно на 40% дешевле Opus 5 и выдаёт ответ более чем на 30% быстрее, а по качеству держит уровень старшего Fable 5.1. Если у тебя что-то крутится на Opus 5 - меняй ID модели на claude-opus-5-5 и проверь эффект.
Вышла модель 22 сентября, и это первый релиз Anthropic после того, как компания сама призвала притормозить гонку моделей. Показательно, куда ушёл фокус: не в новый рекорд на бенчмарке, а в цену часа работы. Ниже - откуда берётся минус 40%, что реально прибавило в уме и что сломается при переезде.
Что вышло: тот же класс, но меньше счёт
Opus 5.5 - прямое продолжение Opus 5: окно контекста в миллион входных токенов, вывод до 128 тысяч (до 300 тысяч через Batch API с бета-заголовком output-300k-2026-03-24). Модель доступна везде сразу: Claude API, Amazon Bedrock, Google Cloud, Microsoft Azure. ID в API - claude-opus-5-5, на Bedrock - anthropic.claude-opus-5-5.
Ключевая заявка Anthropic звучит так: в большинстве задач Opus 5.5 работает на уровне Fable 5.1, но стоит вдвое дешевле и генерирует быстрее. То есть модель, за которую ещё месяц назад платили как за флагман, теперь доступна по цене среднего тарифа. Заодно подняли пятичасовые лимиты на Pro, Max, Team и посадочных Enterprise-тарифах - разработчикам в редакторе это заметнее любых бенчмарков.
Откуда берётся минус 40%
Экономия складывается из двух слагаемых, и это важно разделять.
Первое - цена за токены упала на 20%. Вход стоит $4 за миллион вместо $5, выход - $20 вместо $25. Кэш-чтения подешевели сильнее: $0,20 за миллион, на 60% меньше, чем у Opus 5. Запись в кэш - $5 против $6,25. Есть и быстрый режим (fast mode) для интерактивной работы - $8 за вход и $40 за выход, дороже, но с меньшей задержкой.
Второе слагаемое хитрее: Opus 5.5 тратит меньше токенов на ту же задачу. Отчасти потому, что по умолчанию думает не так глубоко, как Opus 5 (об этом ниже), отчасти - за счёт более экономной работы с инструментами. Сложи одно с другим, и на типовых нагрузках Anthropic обещает те самые примерно 40% экономии. Это оценка самой компании, у тебя цифра будет зависеть от доли кэш-чтений и глубины размышлений, но направление такое.

Что с умом: где Opus 5.5 реально прибавил
Основной прирост - в агентном кодинге, и он крупный. Terminal-Bench 4.0 вырос до 66,4% против 52,3% у Opus 5 - плюс 14 пунктов и новый рекорд на этом замере. SWE-bench Pro прибавил почти 11 пунктов, до 89,9%. CursorBench 4.0 - 57,8% против 46,6%, FrontierCode - 54,4% против 48,0%. По работе со знаниями (GDPval) рейтинг Elo поднялся с 1708 до 1846, по управлению компьютером (OSWorld) - с 74,0% до 81,8%.
Цифры сняты с таблицы самой Anthropic, так что скидку на маркетинг держи. Я писал, почему к пунктам на лидербордах вообще стоит подходить с недоверием - здесь то же правило. Но даже с поправкой картина честная: рывок именно там, под что модель и затачивалась, - долгие агентные забеги с кодом и инструментами.

effort теперь medium по умолчанию
Самое незаметное изменение, которое ты почувствуешь без единой правки кода: глубина размышления. У Opus 5 параметр effort по умолчанию стоял на high, у Opus 5.5 - на medium. Запрос, который не задаёт effort явно, теперь думает меньше: быстрее и дешевле, но и поверхностнее на сложных задачах.
Сам параметр стал основным рычагом управления: адаптивное мышление включено всегда, а его глубину задаёшь пятью ступенями - low, medium, high, xhigh, max. Это и есть второе слагаемое той самой экономии: по умолчанию модель тратит меньше токенов на размышление, потому что дефолт сместили на ступень вниз.
Три ломающих изменения при миграции
Если вызываешь Opus 5 по API и просто меняешь ID, код может упасть на том же наборе граблей, что и у Fable 5.1 - семейство ведёт себя одинаково.
Первое: мышление нельзя выключить. thinking: {"type": "disabled"} вернёт ошибку 400. Адаптивное thinking теперь встроено, отключается только глубина через effort.
Второе: принудительный вызов инструментов больше не поддерживается. tool_choice типа any или конкретного инструмента вернёт 400. Оставляй auto, а для строгого JSON используй strict tool use или structured outputs.
Третье: старый инструмент управления компьютером computer_20251124 на Claude API и Google Cloud больше не принимается - переезжай на computer_toolset_20260801. Плюс тонкость из той же серии: thinking-блоки привязаны к модели и разговору, поэтому историю сообщений держи в режиме append-only, без задним числом переписанных ходов.
Тон: Claude снова похож на Claude
Anthropic отдельно отметила работу над манерой ответа: модель ставит главное в начало, реже сыплет жаргоном и идиосинкразиями и лучше держит заданные правила письма. Это ответ на самую частую претензию к Opus 5 - что он отвечает как перестраховщик.
Судя по реакции сообщества, попали. В r/ClaudeAI за сутки взлетел пост с заголовком «Claude is BACK»: автор пишет, что модели начиная с Opus 4.7 были невыносимо «параноидальными», а Opus 5.5 наконец снова ведёт себя как соратник. Оговорюсь честно - это настроение фанбазы, а не замер. Один рецензент с философским образованием заметил и обратную сторону: Opus 5.5 стал глаже и чаще начинает ответ с «ты прав», как свежие GPT, хотя всё ещё спорит с твоими исходными предпосылками. Стало модель мягче или удобнее - решай на своих задачах.
Кому обновляться, кому нет
Сидишь на Opus 5 - обновляйся почти без раздумий: тот же класс или выше, дешевле, быстрее, выше лимиты. Единственное, что стоит сделать перед переключением, - перечитать раздел про effort и три ломающих изменения, чтобы не поймать тихую деградацию или падение по API.
Гоняешь многочасовые автономные забеги, где важен потолок ума, - Fable 5.1 всё ещё выше, но вдвое дороже. Разумная схема прежняя: рутина на Opus 5.5, эскалация на Fable, когда задача того стоит.
Мне в этом релизе нравится сам вектор. Гонка «наш бенчмарк выше» упёрлась в погрешности измерений, и деньги теперь делают не на баллах, а на цене владения: час агентной работы стоит меньше при том же качестве. Для тех, кто строит на агентах процессы, а не играет с чатом, это важнее любого лидерборда.
