4 сентября 2026 года модельная команда Ant Ling (inclusionAI, открытая AGI-инициатива Ant Group из экосистемы Alibaba) выпустила Ling-3.0-flash-Sante — медицинский дообученный вариант Ling-3.0-flash. Модель заявляет результаты на уровне флагманских моделей на медицинских бенчмарках и уже доступна бесплатно через хост-апи на OpenRouter и Vercel AI Gateway.

Что произошло
Ling-3.0-flash-Sante построена на базе Ling-3.0-flash: MoE-архитектура с 124 млрд общих параметров и 5,1 млрд активных на токен, контекст около 262 тыс. токенов (Vercel указывает 256K), максимальный вывод 32K токенов. По таблице бенчмарков из официального анонса модель набирает 83,8 на DiagnosisArena-MCQ против 81,9 у GPT-5.6 Sol, 78,4 у Kimi K3 и 76,2 у Gemini 3.6 Flash. На MedXpertQA-Text результат скромнее: 53,9 при 60,2 у GPT-5.6 Sol, 62,4 у Gemini 3.6 Flash и 53,5 у Kimi K3. По медицинской этике (MedEthicAlign, AFUSAFE-MedSCE) в анонсе заявлены результаты выше Claude Opus 4.8 и чуть ниже GPT-5.6 Sol. Модель доступна только как хост-апи: бесплатно на OpenRouter (идентификатор inclusionai/ling-3.0-flash-sante:free, провайдер Novita AI) и в Vercel AI Gateway, где действует промо до 4 октября 2026 года. Веса не опубликованы: на Hugging Face модель возвращает 401.
Контекст
inclusionAI — модельная команда Ant Group в экосистеме Alibaba, выпускающая линейку моделей Ling. Базовая Ling-3.0-flash доступна на Hugging Face, а ранее команда выпустила на той же базе Ling-3.0-flash-Fin — финансовый дообученный вариант под лицензией MIT. Ling-3.0-flash-Sante продолжает этот паттерн: доменная специализация общей MoE-базы под узкую область. Все бенчмарк-цифры по новой модели приведены в графике официального анонса; техрепорта, описания методологии дообучения и независимого воспроизведения результатов пока нет.
Почему это важно для индустрии
Бесплатная медицинская MoE-модель с бенчмарками на уровне флагманских моделей на медицинских задачах снижает порог входа для клинических приложений: медицинские рассуждения, проверка безопасности лекарственной терапии и retrieval по доказательной базе доступны через стандартный API без самохостинга 124-миллиардной модели. Для стартапов это бесплатный ресурс для прототипирования клинических ко-пайлотов и оценки медицинских сценариев. При этом закрытые веса, метрики, заявленные самой командой без техрепорта, и отсутствие SLA ограничивают использование модели в production и воспроизводимость результатов.
Почему это важно для пользователей
Модель можно попробовать прямо сейчас бесплатно: на OpenRouter под идентификатором inclusionai/ling-3.0-flash-sante:free и в Vercel AI Gateway, где промо действует до 4 октября 2026 года. Контекст около 262 тыс. токенов удобен для длинных медицинских документов и клинических кейсов. Чтобы проверить заявления, стоит сравнить модель на собственных медицинских промптах с базовой Ling-3.0-flash и с GPT-5.6 Sol.
Что пока неизвестно / ограничения
Все метрики заявлены самой командой и взяты из графика анонса: нет техрепорта, нет описания протокола оценки (версии датасетов, промпты, параметры инференса) и нет независимого воспроизведения. Без открытых весов архитектурные заявления проверить самостоятельно нельзя. Картина по бенчмаркам неравномерная: лидерство на DiagnosisArena-MCQ соседствует с отставанием от GPT-5.6 Sol и Gemini 3.6 Flash на MedXpertQA-Text, что может указывать на узкую специализацию. У модели нет SLA, а ценообразование и условия доступа после окончания промо не раскрыты.
Источники
- Ant Ling — официальный анонс Ling-3.0-flash-Sante (X/Twitter, 4 сентября 2026)
- OpenRouter — Ling 3.0 Flash Sante (free): спецификация, провайдер Novita AI, цена 0
- Vercel AI Gateway — Ling 3.0 Flash Sante (Free): MoE 124B/5.1B, 256K контекст, промо до 04.10.2026
Автор
Look at AI, редакция
