Стартап Positron AI из Рино, штат Невада, делающий чипы для инференса, то есть для запуска уже обученных ИИ-моделей, привлёк 875 млн долларов при оценке 5 млрд. Раунд собран двумя траншами, в нём участвуют NEA, Andra Capital, Atreides Management, Valor Equity Partners, SemiAnalysis Capital и Джим Кларк, основатель Silicon Graphics и Netscape. Ещё семь месяцев назад компания стоила чуть выше 1 млрд, так что оценка выросла более чем в четыре раза. Деньги пойдут на новое поколение железа, чип Asimov и систему Titan, на инженерный дата-центр и на масштабирование действующей системы Atlas. Архитектурная суть ставки — большие объёмы массовой памяти LPDDR5X на чип вместо дефицитной HBM.

Что произошло
Раунд разделён на две части: 375 млн долларов Series C при пре-мани оценке 3,5 млрд, где со-лидерами выступили NEA, Andra Capital, Atreides Management, Valor Equity Partners и SemiAnalysis Capital аналитика Дилана Пателя, и Series C-1 на сумму до 500 млн от NEA и Джима Кларка. Точкой отсчёта текущего роста был февраль 2026 года, когда Series B на 230 млн долларов оценивал компанию чуть выше 1 млрд. Основная часть средств направляется на кремниевый чип Asimov: его тайпаут на техпроцессе TSMC N3P запланирован на конец 2026 года, серийное производство на вторую половину 2027-го, а объём памяти на одном чипе составит от 288 ГБ до 2304 ГБ. Рядом проектируется система Titan из четырёх-восьми чипов Asimov, рассчитанная на модели свыше 16 трлн параметров и контекст свыше 10 млн токенов на узел. Дополнительно компания построит инженерный дата-центр мощностью более 2 МВт и нарастит производство текущей системы Atlas, которая уже развёрнута более чем в 50 стойках Oracle Cloud Infrastructure; среди названных клиентов — Parasail, Jump Trading и i3d.net. В пресс-релизе компания также заявляет о реализации более 90% доступной пропускной способности памяти в своих системах.
Контекст
Сдвиг, который фиксирует этот раунд, происходит на уровне всей ИИ-инфраструктуры: центр тяжести рынка перемещается от обучения моделей к инференсу, где узким местом становится память, а не вычислительная мощность в FLOPS. Традиционный путь через дорогую память HBM и её упаковку CoWoS упирается в дефицитные цепочки поставок, и именно от этой зависимости Positron сознательно уходит, строя архитектуру вокруг массовой памяти LPDDR5X. По той же причине, согласно контексту раунда, Nvidia сократила планы по Rubin Ultra примерно с 1 ТБ памяти HBM4E до 192 ГБ. Свою ставку Positron формулирует через экономику «токены за доллар» и «токены за ватт», и её деньгами поддерживают, помимо уже названных фондов, Qatar Investment Authority, Cisco Investments и Hudson River Trading. Для рынка капитала это знак того, что инференс перестал быть побочным приложением к обучающим GPU и превратился в самостоятельный сегмент кремния, за который инвесторы готовы платить на ранней стадии.
Почему это важно для индустрии
Для индустрии рынок капитала деньгами подтвердил, что инференс-кремний стал самостоятельным активом: привлекать финансирование под такое железо стало проще, а покупатели GPU получили дополнительный аргумент в торге с поставщиками. Нарратив «память важнее FLOPS» уже влияет на планирование инфраструктуры, а появление значимого не-GPU пути инференса диверсифицирует рынок оборудования. Если ставка на LPDDR5X оправдается, к 2027 году возможна коммодитизация длинного контекста: цена генерации токенов может заметно снизиться, а память перестанет быть дефицитным ресурсом. Ближайшая контрольная точка — конец 2026 года: подтвердится ли тайпаут Asimov на TSMC N3P в срок или сдвинется. Ожидается расширение развёртываний Atlas в Oracle Cloud Infrastructure и у сторонних провайдеров, а рынок будет сверять обещания компании с фактическими поставками и выручкой.
Почему это важно для пользователей
Прямого эффекта на текущие модели и сервисы нет: Atlas обслуживает конкретных клиентов через Oracle Cloud Infrastructure, публичного self-serve API не заявлено, открытых цен и задержек нет. Реальный способ столкнуться с технологией сегодня — инференс через Oracle Cloud Infrastructure и партнёров компании. Для ML-инженеров и продуктовых команд практические действия сейчас тактические: профилировать собственные нагрузки и понять, является ли инференс memory-bound, а также держать инференс-бэкенд сменным, строя абстракцию над провайдерами в стиле OpenAI-совместимых API, чтобы не зависеть от одного поставщика. Если заявления о LPDDR5X подтвердятся, инференс подешевеет, и к концу 2027 — началу 2028 года возможна нормализация дешёвого огромного контекста: агенты с постоянной памятью на весь корпус документов компании, частичный отказ от тяжёлой RAG-обвязки и новые классы продуктов с UX, рассчитанным на миллионы токенов контекста.
Что пока неизвестно / ограничения
Рост оценки с чуть выше 1 млрд до 5 млрд долларов за семь месяцев — финансовый сигнал, а не научное подтверждение: рынок капитала оценивает нарратив и дефицит, а не воспроизводимые бенчмарки, и сама оценка ничего не говорит об истинности заявления о реализации более 90% доступной пропускной способности памяти. Методологии этого замера в источниках нет: не указано, какие модели использовались, какой размер батча и плотные это модели или MoE. Кроме того, высокая утилизация полосы LPDDR5X не равна HBM-классу абсолютной полосы, поскольку у LPDDR5X принципиально ниже пиковая полоса на чип. Чип Asimov и система Titan — обещания будущего железа, оценивать их как текущие возможности методологически нельзя, а тайпаут может сдвинуться. Независимых публичных бенчмарков Atlas и публичной методологии замеров утилизации памяти пока не опубликовано, так что ключевая техническая проверка этой истории ещё впереди.
Источники
- Пресс-релиз Positron AI: Positron AI Raises $875 Million at a $5 Billion Valuation to Bring Its Next-Generation Inference Silicon to Market
- Positron AI — официальная страница Press с архивом релизов компании
- Reuters: AI chip startup Positron's valuation skyrockets in latest funding round
- The Wall Street Journal: Positron Valued at $5B in New Funding as Demand for AI Chips Surges
Автор
Look at AI, редакция
