В официальной документации Claude Platform вышло руководство Prompting Claude Opus 5.5 — набор паттернов промптинга под модель claude-opus-5-5. Ключевое отличие от Opus 5: адаптивное мышление (adaptive thinking) включено всегда, а глубина рассуждений задаётся единым параметром effort с дефолтом medium. По данным документации, на этом уровне модель соответствует или превосходит Opus 5 на high на кодинг- и знаниевых бенчмарках, генерируя токены более чем на 30% быстрее и укладываясь в меньшее число токенов. Одновременно задокументированы четыре breaking-изменения API, ломающие конфиги, перенесённые из Opus 5 без правок.
Что произошло
Раздел prompt engineering в документации Claude Platform пополнился страницей Prompting Claude Opus 5.5 с паттернами работы под модель claude-opus-5-5. В ней перечислены уровни параметра effort — low, medium, high, xhigh и max — и зафиксированы четыре breaking-изменения. Первое: запросы с thinking, имеющим тип disabled, или с budget_tokens возвращают 400 invalid_request_error. Второе: принудительный выбор инструмента tool_choice со значениями any и tool больше не поддерживается. Третье: thinking-блоки привязаны к модели и конкретному разговору, а префиксные изменения блокируются по умолчанию для аккаунтов с 31 августа 2026 года. Четвёртое: инструмент computer_20251124 заменён на computer_toolset_20260801 в Claude API и Google Cloud. В документации также доступна связанная страница What's new in Claude Opus 5.5.
Контекст
Раньше глубина рассуждений во флагманских моделях Claude была ручной настройкой: бюджет размышлений задавался в токенах через budget_tokens, размышления можно было полностью отключить для простых задач, а гарантированный вызов инструмента обеспечивался через tool_choice. Новое руководство закрепляет смену парадигмы: рассуждения становятся неотключаемой частью инференса, и вместо ручных бюджетов с принудительными вызовами остаётся единственная ручка effort, определяющая, насколько глубоко модель думает. По смыслу это не список новых фич, а изменение контракта API: команды больше не решают, думать ли модели вообще, а выбирают только степень глубины. При этом сам документ остаётся вендорской документацией, а не исследовательской публикацией, поэтому его количественные утверждения следует читать как заявления производителя.
Почему это важно для индустрии
Для команд, обслуживающих продакшн-агентов, эффект миграционный и экономический одновременно. Существующие пайплайны со старыми настройками при переносе на claude-opus-5-5 ломаются, а новые деплои возможны сразу, но конфиги Opus 5 переносятся только вручную: первая инженерная задача сегодня — аудит текущих вызовов на отключение thinking, принудительный tool_choice и устаревший computer-инструмент. Отдельный операционный риск: смена effort между запросами сбрасывает prompt cache, что напрямую бьёт по стоимости и латентности агентских циклов, варьирующих глубину рассуждений на ходу. Экономический сигнал в том, что качество уровня Opus 5 на high теперь, по данным документации, достижимо на medium дешевле, быстрее и меньшим числом выходных токенов; если паритет подтвердится независимыми замерами, типовой профиль агентских пайплайнов сместится на medium, экосистема харнессов, калькуляторов стоимости и роутеров задач начнёт адаптироваться к семантике effort, а сопоставление моделей по бенчмаркам без указания effort потеряет методологический смысл.
Почему это важно для пользователей
Если вы тестируете claude-opus-5-5, документация советует стартовать с effort medium и max_tokens 128000 для агентского кодинга: thinking расходует лимит max_tokens, даже когда блоки размышлений не возвращаются, поэтому заниженный лимит незаметно режет качество. Настройки из Opus 5 переносить не стоит — стартовый профиль у модели другой, а блоки ответа надёжнее выбирать по полю type, а не по позиции в массиве. Глубину размышлений предлагается снижать параметром effort, а не промптовыми инструкциями: по данным документации, такой путь даёт качество уровня Opus 5 high дешевле и быстрее.
Что пока неизвестно / ограничения
Главное заявление — о том, что claude-opus-5-5 на effort medium соответствует или превосходит Opus 5 на high на кодинг- и знаниевых бенчмарках — в источниках не сопровождается перечнем бенчмарков, описанием харнесса, размерами выборок и дисперсией, поэтому требует независимой проверки на реальных нагрузках. Не раскрыта и методика измерения 30-процентного ускорения генерации токенов. Документация остаётся вендорским материалом: долгосрочные сценарии вроде закрепления always-on мышления как отраслевого стандарта и открытый вопрос о том, останется ли effort управляемой ручкой или свернётся в автоматический режим, являются интерпретациями, а не гарантиями. Перед миграцией детали вроде поведения блокировки префиксных изменений thinking-блоков для аккаунтов, отмеченных датой 31 августа 2026 года, стоит перепроверять по первоисточнику.
Источники
- Prompting Claude Opus 5.5 - Claude Platform Docs
- What's new in Claude Opus 5.5 - Claude Platform Docs
Автор
Look at AI, редакция
