29 сентября 2026 года на OpenAI DevDay в Сан-Франциско анонсировали более 20 новинок, и главная из них меняет саму логику ChatGPT: вместо чата — постоянно работающие агенты Dots на модели GPT-6 Astra, у каждого свой облачный компьютер, доступ через ChatGPT, Slack и Teams, включая голосовые звонки. Второй ход — ценовой: в API вышла дешёвая GPT-6.1 Sol, которая держит уровень Astra примерно за пятую часть цены, параллельно запущен скоростной режим Ultrafast на железе Cerebras за шестикратную наценку. Разработчикам тот же агентный харнесс отдали через публичную бету Agents API и связку Bedrock Managed Agents с AWS, а тарифную линейку перестроили, включая возврат Pro 200.

image

Что произошло

Ядро конференции составили четыре блока анонсов. Первый — агенты Dots: работающий на GPT-6 Astra always-on агент с собственным облачным компьютером; в ChatGPT, Slack и Teams с ним можно общаться даже голосовыми звонками, через плагины открыт каталог более чем из 4000 приложений, а при желании к агенту подключают и собственный компьютер пользователя с его локальными файлами. Dots включены в тарифы Pro и Business Premium, первый Dot идёт бесплатно, а в планах Enterprise, Edu и Healthcare активация происходит через администратора в бете и по умолчанию выключена. Второй блок — модель GPT-6.1 Sol: по формулировке OpenAI она держит уровень Astra примерно за пятую часть цены, а именно $2 за миллион входных и $10 за миллион выходных токенов; кэшированный вход подешевел вдвое, с $0.20 до $0.10. Третий блок — режим Ultrafast, инференс GPT-6 Astra на железе Cerebras с заявленной скоростью до 750 токенов в секунду: в API он открыт всем с низкими лимитами, в ChatGPT Work и Codex — на тарифах Pro 500 и Enterprise, а тарификация равна шестикратной стандартной цене Astra, то есть $60 за вход, $6 за кэш и $300 за выход в пересчёте на миллион токенов. Четвёртый блок — тарифная перестройка: вернулся Pro 200 за $200 в месяц, но новым подписчикам лимиты урезаны вдвое, x10 вместо прежних x20, а действующим прежний объём сохраняют до 29 октября; Pro 500 за $500 в месяц даёт лишь двадцатипятикратные лимиты Plus. Отдельно объявили публичную бету Agents API и Bedrock Managed Agents в партнёрстве с AWS.

Контекст

Главное в этом пакете — сдвиг харнесса, а не модели: научная новизна скромная, зато продуктовая и дистрибуционная — большая. OpenAI переводит ChatGPT из чата в платформу постоянно работающих агентов, где работа идёт по принципу делегированных обязанностей: пользователь поручает задачу агенту с постоянным рабочим местом, а не ведёт диалог с ботом. Вторая линия — экономика: анонс сознательно делит рынок API на два яруса, где массовый фоновый агентный труд предполагается гонять на дешёвой Sol, а интерактивные сценарии с потребностью в скорости — на Ultrafast с наценкой за специализированный инференс на железе Cerebras, при этом кэширование резко снижает стоимость выполняемого шага агента. Третья линия — конкуренция: в пересказе прямо упомянуты Grok Bot и Muse, которым дешёвая модель бросает вызов по цене, так что вероятна волна ответных движений. Наконец, DevDay показывает стратегию дистрибуции: агент получает рабочее место там, где у человека уже есть харнесс и данные, будь то чат, рабочий мессенджер или его собственная машина.

Почему это важно для индустрии

Для разработчиков и компаний главный пункт DevDay — не сами Dots, а открытие агентного харнесса: публичная бета Agents API и Bedrock Managed Agents позволяют собрать собственного always-on агента в собственном окружении AWS, вместо того чтобы строить обёртку над чужим подписочным продуктом. В паре с дешёвой Sol для массовой агентной нагрузки прототип такого агента — вопрос дней, а не квартала. Рынок API делится на два яруса, фоновый массовый труд на дешёвых моделях и интерактивная скорость с наценкой за специализированный инференс, поэтому архитектурам придётся развести потоки на фоновые и интерактивные пути с разным выбором модели. Из-за кэширования конкуренция смещается от цены за токен к цене за выполненный шаг агента, и это давление в первую очередь ощущают тонкие обёртки над API, у которых нет собственных данных, дистрибуции и вертикальных сценариев. Конкурентам вроде Grok Bot и Muse придётся отвечать на цену Sol снижениями, а жёсткая пересборка лимитов топовых подписок показывает, что юнит-экономику агентных сервисов теперь считают по каждому шагу.

Почему это важно для пользователей

Попробовать Dots можно сразу на подписках Pro или Business Premium: первый агент включён бесплатно, а в планах Enterprise, Edu и Healthcare его активирует администратор в бете, при этом по умолчанию функция выключена. Разговоры с Dot не расходуют лимиты подписки, а вот задачи в ChatGPT Work и Codex списываются как обычно, поэтому рутину выгоднее именно делегировать агенту. Sol в обычном чате не появится: модель доступна через API под идентификатором gpt-6.1-sol, а также внутри ChatGPT Work и Codex. Режим Ultrafast в API открыт всем, и низких лимитов хватает, чтобы сравнить скорость генерации со стандартным Astra на собственных задачах. Действующим подписчикам Pro 200 стоит заранее проверить условия счёта: новым подключениям тариф пересмотрен, а прежний объём действующим сохраняют до 29 октября.

Что пока неизвестно / ограничения

Формулировка «уровень Astra» для GPT-6.1 Sol не подкреплена ни одним из источников бенчмарками или методологией оценки: это позиционирование, а не научный результат, и проверять его придётся независимыми сравнениями. Заявленная скорость Ultrafast — цифра вендора о пропускной способности на его железе: условия замера, латентность и стабильность под нагрузкой не раскрыты. Agents API открыта только в бете, Bedrock Managed Agents тоже на ранней стадии, а данных о реальной надёжности always-on агентов вне демонстраций пока нет. Появление независимых сравнений Sol с Astra и первые сведения о живой надёжности агентов — ожидаемые, но пока не свершившиеся события; прогноз о двухъярусном рынке API остаётся интерпретацией цен, а не установленным фактом.

Источники

Автор

Look at AI, редакция