Anthropic представила Claude Fable 5.1 и Claude Mythos 5.1 — это одна модель с двумя уровнями защит: Fable 5.1 открыта всем на всех платформах, а Mythos 5.1 выдают только по программам проверенного доступа для кибербезопасности и биологии. Базовые тарифы остались прежними, но чтение из кэша подешевело в четыре раза, поэтому счета за агентные сценарии могут снизиться почти вдвое. По вендорским замерам Fable 5.1 обходит и Fable 5, и Opus 5, работая при этом примерно вдвое быстрее Opus 5.

image
image

Что произошло

Anthropic разделила релиз на две версии одной модели. Claude Fable 5.1 доступна всем на всех платформах, её API-идентификатор — claude-fable-5-1; Claude Mythos 5.1 отличается ослабленными safeguards и выдаётся только участникам программ проверенного доступа в кибербезопасности и life sciences. Цены на вход и выход не изменились — 10 и 50 долларов за миллион токенов, — а чтение из кэша подешевело с одного доллара до 0,25 доллара за миллион токенов. По замерам Anthropic за четыре недели августа 2026 года это даёт около 25% экономии на обычных задачах и до 45% на агентных, где кэш-чтения составляют до 65% счёта, потому что агент перечитывает один и тот же контекст на каждом шаге. В бенчмарках Fable 5.1 набирает 55,8% на Terminal-Bench 4.0 (у Mythos 5.1 — 60,9%), 52,6% на Terminal-Bench-Science 0.1 против 24,7% у Fable 5, 65,0% на Humanity's Last Exam с инструментами и 73,4% на CursorBench 3.2.0. В день релиза Cognition объявила о переводе трафика Opus 5 в Devin на Fable 5.1, а также была анонсирована EFS, переносящая хранение данных на инфраструктуру клиента.

Контекст

Кэш в API больших языковых моделей позволяет повторно читать уже обработанный контекст заметно дешевле, чем обрабатывать его заново, и именно на этом держится экономика агентных систем: агент на каждом шаге пайплайна перечитывает один и тот же контекст, поэтому в агентных сценариях кэш-чтения достигают 65% итогового счёта против примерно 40% на обычных задачах. Цена таких чтений до этого релиза была заметно выше базовой стоимости обработки, и её снижение влияет на итоговый счёт сильнее, чем любые изменения базовых тарифов, которые в этот раз вообще не тронули. Разделение одной модели на общедоступную Fable и гейтнутую Mythos с ослабленными safeguards — продолжение политики Anthropic по контролируемому доступу к сильным моделям в чувствительных областях: более свободная версия достаётся только проверенным организациям в кибербезопасности и биологии, а широкая публика получает вариант с более строгими защитами.

Почему это важно для индустрии

Для строителей агентных систем это редкий случай, когда юнит-экономика улучшается без каких-либо изменений в продукте: вендор не тронул цены входа и выхода, но срезал на 75% самую дорогую часть агентного счёта. Длинные многошаговые продукты — кодинг-агенты вроде Devin, enterprise-пайплайны с переиспользуемым контекстом — становятся заметно дешевле, а сценарии, которые раньше не сходились по юнит-экономике, могут выйти в рентабельность. Cognition уже перевела Devin на Fable 5.1 в день релиза, показывая, как крупные потребители оценивают эту миграцию. Публичная дельта 55,8% против 60,9% между Fable 5.1 и Mythos 5.1 на Terminal-Bench 4.0 — редкая количественная оценка того, сколько возможностей стоит ужесточение safeguards, и полезный сигнал о trade-off между безопасностью и полезностью. Если четырёхкратное удешевление кэша приживётся, конкуренты, вероятно, начнут повторять этот шаг, что давит на экономику всех агентных систем и сдвигает дизайн промптов к кэш-дружественным архитектурам со стабильными префиксами и персистентным контекстом проекта.

Почему это важно для пользователей

Если вы работаете с Claude API, Claude Code или агентными пайплайнами, миграция сводится к смене идентификатора модели на claude-fable-5-1: тарифный план менять не нужно, новые цены уже действуют. Реальный выигрыш зависит от того, какую долю в вашем счёте занимают кэш-чтения, поэтому первый практический шаг — снять эту долю с биллинга, а второй — прогнать собственные evals на Fable 5.1 против текущей модели до перевода продакшена. По замерам вендора модель примерно вдвое быстрее Opus 5; effort по умолчанию выставлен в High в Claude Code и в Medium на claude.ai, так что поведение можно дополнительно подстроить под задачу. Третий шаг — вынести стабильный контекст в кэшируемый префикс: чем больше повторно используемого контекста в вашем пайплайне, тем сильнее эффект новой цены кэш-чтений на итоговый счёт.

Что пока неизвестно / ограничения

Все цифры о возможностях модели — самозамеры Anthropic без раскрытой методологии, и независимого подтверждения прироста пока нет. Скачок на Terminal-Bench-Science 0.1 с 24,7% до 52,6% внутри минорного обновления 5 к 5.1 аномально велик для точечного релиза и является первым кандидатом на независимое воспроизведение: либо прирост реален, либо результат сильно чувствителен к формату и подсказкам бенчмарка. Разница между Fable 5.1 и Mythos 5.1 на Terminal-Bench 4.0 — тоже вендорский замер. Научная новизна минорного релиза 5.1 в анонсе не показана. Ожидаемая экономия проверяется по собственному биллингу каждого клиента и зависит от структуры его расходов, поэтому универсальной цифры для всех нагрузок не существует.

Источники

Автор

Look at AI, редакция