Anthropic представила Claude Opus 5.5 — первую модель семейства Claude 5.5. По заявлению компании, она превосходит Opus 5 в агентном программировании, computer use и knowledge work, работая при этом на 30%+ быстрее и примерно на 40% дешевле на типичных задачах. Цена доступа к флагманскому уровню через API опустилась до $4 за 1M входных и $20 за 1M выходных токенов против $5/$25 у Opus 5, а чтение кэша подешевело с $0,50 до $0,20 за 1M. Anthropic также подняла 5-часовые лимиты использования на планах Pro, Max, Team и Enterprise и подтвердила, что Claude Sonnet 5.5 и Haiku 5.5 выйдут в ближайшие недели.

image

Что произошло

Anthropic выпустила Claude Opus 5.5 — первую модель линейки Claude 5.5, уже доступную через API и в Claude Code, то есть это деплоируемое изменение, а не исследовательский демо-анонс. Компания заявляет превосходство над Opus 5 в агентном программировании, computer use и knowledge work при одновременном ускорении более чем на 30% и удешевлении примерно на 40% на типичных задачах. Тарифы API: $4 за 1M входных токенов, $20 за 1M выходных и $0,20 за 1M при чтении кэша; у Opus 5 эти же позиции стоили $5, $25 и $0,50. Для latency-чувствительных сценариев введён ускоренный Fast-режим — в Claude Code и на Anthropic Platform он работает до 2,5x быстрее за $8 и $40 за 1M входных и выходных токенов соответственно. В вендорских бенчмарках модель набрала 66,4% на Terminal-Bench 4.0, 54,4% на FrontierCode v1.1 и 67,7% на Humanity's Last Exam с инструментами; по утверждению Anthropic, она обгоняет Opus 5 и GPT-6 Astra на большинстве агентных тестов. Одновременно компания подняла 5-часовые лимиты использования на планах Pro, Max, Team и Enterprise и подтвердила, что Claude Sonnet 5.5 и Haiku 5.5 появятся в ближайшие недели.

Контекст

Чтобы оценить масштаб, важна динамика предыдущего поколения: Opus 5 стоил $5/$25 за 1M токенов и $0,50 за чтение кэша, и его цена считалась ориентиром для флагманского класса. Opus 5.5 впервые опускает эту планку — и, судя по всему, намеренно: типичный паттерн Anthropic состоит в том, что флагман прокладывает ценовую тропу, а младшие модели семейства её закрепляют, поэтому выход Sonnet 5.5 и Haiku 5.5, вероятно, растянет новое соотношение цены и качества на весь ценовой стек. Показательна и сама риторика компании: Anthropic открыто предупреждает, что на таких уровнях возможностей разрыв с Claude Fable 5.1 в реальных задачах меньше, чем показывают бенчмарки. Это редкое для отрасли признание того, что вендорские цифры на синтетических тестах — слабый прокси реальной работы, и одновременно подтверждение того, что инфляция бенчмарков стала системной проблемой, которую сами разработчики больше не скрывают.

Почему это важно для индустрии

Главное изменение для индустрии — экономика: флагманский уровень возможностей подешевел с $5/$25 до $4/$20 за 1M токенов, а чтение кэша — с $0,50 до $0,20, то есть себестоимость агентных пайплайнов и long-running задач снижается напрямую и проверяемо, без опоры на маркетинговые формулировки. Для команд, строящих продукты на Claude, это расширяет набор юнит-экономически жизнеспособных сценариев: то, что раньше не сходилось по cost-per-task, может пройти после пересчёта. Fast-режим добавляет опцию «заплатить за скорость» для интерактивных UX-сценариев, где wall-clock время критичнее цены. Одновременно снижение цены флагманского уровня создаёт давление на конкурентов, которым теперь приходится объяснять собственные прайс-листы, а анонс Sonnet 5.5 и Haiku 5.5 означает, что основная продакшен-нагрузка в ближайшие недели, скорее всего, сместится на более дешёвые модели семейства, а Opus 5.5 останется для сложных агентных циклов. Если тренд «каждое поколение флагмана заметно дешевле и быстрее» сохранится, агентные воркфлоу рискуют стать стандартным слоем продукта, а ценность сместится от доступа к модели к оркестрации и верификации результатов.

Почему это важно для пользователей

Для тех, кто работает с Claude Code, API или использует Claude для больших кодовых баз и длительных задач, изменения ощутимы уже сейчас: существующие пайплайны можно перевести с Opus 5 на Opus 5.5 без изменения кода и после собственных регрессионных проверок получить примерно 40% экономии и ускорение на 30%+ на типичных задачах. Поднятые 5-часовые лимиты на Pro, Max, Team и Enterprise снижают трение для команд, работающих внутри подписок, а Fast-режим даёт выбор для тех, кому важна скорость отклика. Anthropic также заявляет о большей устойчивости модели к prompt injection. Компания приводит показательные примеры: миграция 680 000 строк кода менее чем за день и переписывание HAProxy с C на Rust за 9,5 часа с прохождением почти всех регрессионных тестов проекта. Ответы модели, по словам вендора, стали короче, что сокращает и расход токенов, и время ожидания.

Что пока неизвестно / ограничения

Большинство заявлений о возможностях пока опирается только на вендорские бенчмарки: абсолютные значения вроде 66,4% на Terminal-Bench 4.0, 54,4% на FrontierCode v1.1 и 67,7% на Humanity's Last Exam даны без базовых линий Opus 5, конфигураций evals и доверительных интервалов, а результат FrontierCode без знания распределения других моделей малоинформативен, как и сам выбор бенчмарков без полных таблиц. Хедлайн-кейсы — миграция 680 000 строк кода и порт HAProxy на Rust — это единичные анонсированные примеры без протокола воспроизведения: n=1, критерии отбора неясны, и они доказывают скорее качество отдельных прогонов, чем системный скачок. Anthropic сама признаёт, что разрыв с Claude Fable 5.1 в реальных задачах меньше, чем показывают бенчмарки, — честно, но это косвенное подтверждение завышенности цифр. Независимые evals ещё не накоплены, и только после их появления станет ясно, насколько вендорские показатели соответствуют практике; для self-hosted и on-prem сценариев релиз ничего не меняет.

Источники

Автор

Look at AI, редакция