🤖 Яндекс опубликовал претрейн модели быстрых ответов Алисы в Поиске

Open-weights модель AliceAI-T5-35B-A0.6B Base выложена на Hugging Face: encoder-decoder с разреженной MoE по рецепту UL2, 512 экспертов на слой с маршрутизацией top-8. Всего 34,35 млрд параметров, на токен активны лишь ~0,6 млрд; контекст — 128K. Бенчмарки Яндекса: сильная фактичность (WikiWebFacts 81,3) и извлечение на 32K (Ruler 94,7), но уступает Qwen 3.5 35B-A3B Base по MATH 500 и MMLU.

🌍 Сверхразреженная MoE с дешёвым инференсом уже в проде: дообученная Alice AI Search отвечает за секунды при сотнях тысяч запросов в минуту. Шаблон для search/QA/RAG-команд.

👤 Веса и код открыты: модель можно скачать, запустить через Transformers и дообучить по готовому LoRA-примеру — реальный референс открытых моделей на русском.

Источник 1: https://huggingface.co/yandex/AliceAI-T5-35B-A0.6B

Источник 2: https://habr.com/ru/companies/yandex/articles/1080654/