Anthropic открыли отдельный сайт claude.dev для команд, которые строят продукты на базе Claude и Claude Code. На нём собраны статьи, видео и build logs от инженеров самой компании: руководства по подбору evals, распределению «усилий» модели, оценке стоимости задачи на Opus 5.5 и кейсы оптимизации claude.ai. Это не релиз модели и не изменение API, а консолидация разрозненных инженерных материалов вендора в один официальный первичный ресурс.



Что произошло
Anthropic переработали подход к инженерным публикациям и открыли отдельный сайт claude.dev, адресованный разработчикам, которые создают продукты на базе Claude и Claude Code. Там собраны статьи, видео и build logs от инженеров самой Anthropic. Материалы посвящены практическим вопросам: как автоматизировать проектирование evals и hillclimbing, то есть итеративное улучшение результата по выбранной метрике; как распределять «усилия» (effort) модели в Claude Code; сколько стоит задача на Opus 5.5; как claude.ai ускорили в 3 раза за две недели. Публикации выходят регулярно: 25 сентября 2026 вышла статья «Building with Claude Sonnet 5.5», 28 сентября 2026 — «Automating eval design and hillclimbing». Отдельно на сайте размещены видеосессии о том, как Claude Code используют компании Ramp и DoorDash.
Контекст
Раньше инженерные руководства по Claude и Claude Code были разбросаны по отдельным блогам и каналам, и команды, строившие на этих моделях, нередко опирались на сторонние пересказы. С запуском claude.dev вендор модели начал передавать практики agent-инжиниринга — evals, skills, контекст-инжиниринг — напрямую через собственный первичный канал. Это заметно на фоне общей картины: методология evals относится к областям, где вендоры обычно редко раскрывают внутренние детали, поэтому сама публикация подобных материалов от автора модели выделяется. По смыслу это шаг дистрибуции платформы, а не самостоятельная контент-инициатива: вендор инвестирует в то, чтобы разработчики строили на его стеке осознанно и удерживались внутри его экосистемы.
Почему это важно для индустрии
Для отрасли ценность не в самом анонсе, а в методологии. production-команды на Claude Code получают единый первичный источник вместо сторонних пересказов, и зависимость от вторичной трактовки практик вендора снижается сразу. Официальный ориентир стоимости задачи на Opus 5.5 даёт базу для пересчёта юнит-экономики агентных систем, а расхождения между собственными замерами команд и опубликованными цифрами становятся сигналом для перепроверки. Если каденс публикаций сохранится — а в конце сентября 2026 вышло два свежих материала — claude.dev может стать де-факто стандартным каналом передачи практик agent-инжиниринга для стека Anthropic, а конкуренция вендоров продолжит смещаться от «голой модели» к экосистеме: первоклассные документы, evals, skills и build logs из первых рук.
Почему это важно для пользователей
Тем, кто уже разрабатывает на Claude Code или присматривается к агентным пайплайнам, сайт стоит добавить в закладки как справочник. Применить его можно немедленно и без новых API-доступов: сравнить собственный eval-процесс с гайдом «Automating eval design and hillclimbing», пересмотреть распределение «усилий» модели в Claude Code, пересчитать стоимость своих агентных задач, используя вендорский ориентир цены на Opus 5.5, и просмотреть видеосессии Ramp и DoorDash на предмет переносимых интеграционных решений. При этом важно понимать границы: изменений тарифов, лимитов или интерфейсов запуск не приносит, это канал передачи знаний, а не появление новых возможностей моделей — закладка в браузер здесь полезнее ожидания обновлений.
Что пока неизвестно / ограничения
В предоставленных материалах видны названия разделов и постов, но не их содержание: из гайда «Automating eval design and hillclimbing» неизвестны метрики, бейслайны, датасеты и условия воспроизводимости, поэтому считать название готовой переносимой методологией нельзя. Утверждения про ускорение claude.ai в 3 раза за две недели и про цену задачи на Opus 5.5 даны без методологии измерений и до публикации деталей относятся скорее к маркетинговому регистру. Неясно, что именно представляет собой параметр «усилий» (effort) в Claude Code и как измеряется его эффект. Тезис, что новый сайт заменит разрозненные блоги, из первоисточников не следует — это интерпретация автора исходного поста. Долгосрочные сценарии вроде консолидации стандартов agent-инжиниринга вокруг документации вендоров остаются спекулятивными: надёжной базы для такого прогноза во входных данных нет.
Источники
- claude.dev Blog / technical writing for people building with Claude
- Automating eval design and hillclimbing with Claude — claude.dev
- Building with Claude Sonnet 5.5 — claude.dev
Автор
Look at AI, редакция
