24 августа 2026 на конференции XRING Chip Technology Communication Conference Xiaomi представила AI Cube — прототип компактного ИИ-компьютера формата mini-PC, рассчитанный на локальный запуск больших языковых моделей. Устройство построено на собственных чипах XRING, заявлено для работы с моделями от 3B до 120B параметров и работает при непрерывной мощности до 150 Вт. Дата выпуска и цена не объявлены.


Что произошло
На презентации Xiaomi раскрыла, из чего состоит AI Cube. O3 выступает основным ИИ-SoC: десятиядерный CPU, шестнадцатиядерный GPU G2-Ultra NX и NPU производительностью 200 TOPS на техпроцессе TSMC 3 нм. Ускоритель O100 выполнен на 6 нм и использует NPU-DRAM-склейку wafer-on-wafer, которая обеспечивает пропускную способность около-памятного вычисления до 1,22 ТБ/с. Третий чип, D100, тоже на 3 нм: двадцатиядерный CPU, шестнадцатиядерный NPU и поддержка памяти до 160 ГБ; он изначально создавался для задач «умного вождения». В прототипе работает связка моделей 120B + 3B с переключением между «быстрым» и «медленным» режимами в зависимости от задачи.
Контекст
Сегмент персональных ИИ-компьютеров до этого фактически задавался NVIDIA: DGX Spark стартовал по цене 3999 долларов и определил формат «домашнего ИИ-суперкомпьютера», против которого теперь позиционируется AI Cube. Вторая часть фона — техническое ограничение, в которое бьёт архитектура Xiaomi. При декодировании языковых моделей скоростью выполнения управляет не количество операций, а пропускная способность памяти, поэтому разгон обмена с памятью арифметически выгоднее простого наращивания числа ядер. Именно поэтому около-памятная связка O100 — самая значимая деталь анонса.
Почему это важно для индустрии
Для отрасли AI Cube значима как вход Xiaomi в сегмент локальных ИИ-машин на собственном кремнии, а не на чипах NVIDIA или AMD. Если прототип доведут до продукта, это станет первым серьёзным конкурентом DGX Spark, сделанным вне США, на техпроцессе TSMC 3 нм и, вероятно, заметно дешевле 3999 долларов. Это усиливает конкуренцию за формат персонального ИИ-суперкомпьютера и ускоряет формирование независимого китайского стека. Для инженеров ценен сам системный паттерн — связка быстрой 3B-модели и медленной 120B с роутингом задач, который можно перенести и на текущее железо.
Почему это важно для пользователей
Для читателя AI Cube задаёт конкретную контрольную точку: мини-компьютер на 150 Вт, который, по заявлению, локально тянет модель 120B параллельно с быстрой 3B-«роутерной» моделью. Если устройство дойдёт до рынка, это готовый формат домашнего ИИ-сервера для агентов без облака и подписок. Стоит следить за анонсом цены и даты выпуска — именно от них зависит, станет ли это рабочим форматом для локальных моделей.
Что пока неизвестно / ограничения
Анонс сделан как прототип: нет даты выпуска, цены, spec-листа и независимых замеров. Заявка «поддержка моделей от 3B до 120B» говорит о ёмкости, а не о производительности — токены в секунду, латентность, качество и производительность на ватт не раскрываются. D100 — переупакованный автомобильный чип, его пригодность под LLM-нагрузки не доказана. Политика маршрутизации между 3B и 120B и оверхед переключения тоже не раскрываются. Все заявленные числа, включая 1,22 ТБ/с у O100, пока не подтверждены воспроизводимыми бенчмарками.
Источники
Автор
Look at AI, редакция
