«Алиса AI» от «Яндекса» больше не требует от человека выбирать, какая нейросеть ответит: система сама оценивает сложность запроса, простые вопросы отправляет быстрым моделям, а расчёты, разбор нескольких документов и пошаговые планы — в режим «Эксперт», где виден ход рассуждений и можно загрузить несколько файлов. В интервью Forbes CEO «Алисы и умных устройств» Валерий Стромов пояснил архитектуру: роутер работает поверх 3–5 моделей, а харнесс держит контекст и подключает поиск, файлы и сервисы. Сейчас всё это доступно бесплатно, но активное использование «Эксперта» в будущем планируют перенести в подписку «Алиса Плюс».

image
image
image

Что произошло

«Алиса AI» научилась автоматически распределять запросы между моделями по их сложности: простые вопросы обрабатывают быстрые модели, а расчёты, анализ нескольких документов и многошаговые планы уходят в режим «Эксперт», где пользователь видит ход рассуждений и может приложить сразу несколько файлов. Включать «Эксперт» вручную можно, но не обязательно: по умолчанию роутинг работает у всех и сам решает, какой уровень модели нужен конкретному запросу. В интервью Forbes Валерий Стромов пояснил, что роутер стоит поверх 3–5 моделей — собственных разработок «Яндекса» и open-source-решений под узкие сценарии, — при этом 80–90% потока задач компания планирует оставлять на своих моделях. Отдельный слой архитектуры — харнесс, обвязка, которая держит контекст диалога и подключает поиск, файлы и сервисы. Сейчас режим «Эксперт» доступен всем пользователям без ограничений, а лучше всего, по словам Стромова, он подходит для покупок и финансовых задач.

Контекст

Смысл обновления не в новой модели, а в смене парадигмы: вместо «одной модели на всё» работает оркестрация, где сложность задачи оценивает система, а не человек. Каскад «быстрая модель по умолчанию плюс тяжёлая reasoning-модель по решению роутера» известен индустрии давно, и тот же путь демонстрируют Perplexity, Cursor и Manus, поэтому новизна подхода «Яндекса» не в идее, а в доведении её до массового продукта. При такой архитектуре ценность смещается от самой модели к харнессу — коду, который хранит контекст диалога и подключает файлы, поиск и сервисы. У подхода есть и экономическое измерение: по словам Стромова, Google с одной универсальной моделью тратит на инференс заметно больше ресурсов, тогда как роутинг позволяет удерживать качество при минимальной стоимости. Если «пирамида» закрепится, конкуренция массовых ассистентов сместится с гонки за единственной лучшей моделью к качеству роутера и харнесса.

Почему это важно для индустрии

Для индустрии «Алиса AI» стала живым продакшен-примером того, что связка «роутер плюс 3–5 моделей плюс харнесс» работает не в демо, а в массовом продукте. По словам Стромова, за счёт роутинга и работы инженеров по оптимизации инференса «Яндекс» получил около 9 млрд рублей экономии в первом полугодии 2025 года, что делает оркестрацию проверяемым путём снижения себестоимости. Для стартапов вывод двойственный: слой «умного роутера» стремительно коммодитизируется, поэтому ценность смещается к харнессу — данным, интеграциям и сервисам вокруг моделей. Классификатор сложности, видимые шаги рассуждения и мультифайловый ввод воспроизводимы в собственных агентах, но публичного API для этого слоя в источниках нет, так что «Алиса AI» остаётся референсом архитектуры, а не платформой. Оркестрация выходит и в B2B: в сентябре 2026 года запускается «Алиса AI для бизнеса» примерно на 80% той же технологии, что станет первым тестом масштабируемости подхода на корпоративные сценарии.

Почему это важно для пользователей

Пользователю больше не нужно разбираться, какая модель «умнее»: сложные задачи — спланировать поездку с бюджетом, сравнить несколько документов, посчитать финансы — можно просто закидывать в чат вместе с файлами, а система сама включит тяжёлый режим. Ход рассуждений виден в интерфейсе, поэтому ответы в «Эксперте» проще проверять, а не принимать на веру. Сейчас всё это работает бесплатно и без ограничений. Нюанс, о котором стоит знать заранее: активное использование «Эксперта» планируют перенести в подписку «Алиса Плюс», и воркфлоу, построенные на бесплатном доступе, стоит проектировать с учётом будущих лимитов.

Что пока неизвестно / ограничения

Ключевые цифры остаются корпоративными заявлениями: экономия около 9 млрд рублей на инференсе — это утверждение из интервью Forbes без раскрытой методологии, из источника неизвестны структура трафика, размеры моделей, железо и база сравнения, поэтому цифра согласуется с логикой роутинга, но не доказывает его преимущество перед одной универсальной моделью. Публичных бенчмарков и метрик точности маршрутизации нет, а главный технический риск — ошибка роутера: если сложный запрос уйдёт в быструю модель, качество упадёт незаметно для пользователя и вручную такой мисроутинг почти не диагностируется. Из источников также невозможно установить, какая именно модель обслуживает режим «Эксперт», как она обучена и как оценена. Наконец, критерии и лимиты будущего переноса «Эксперта» в подписку «Алиса Плюс» пока не раскрыты.

Источники

Автор

Look at AI, редакция