OpenAI перенастроила расход квоты подписки ChatGPT на модель GPT-6 Astra: тяжёлые операции класса «long tail» — длинные агентные сессии, 3D-моделирование и подобные — по заявлению компании теперь расходуют до 3–4 раз меньше квоты, при этом качество самой модели не меняется. Об изменении 6 сентября объявил в X лид Codex и ChatGPT Тибо Сотья. Решение пришло на фоне жалоб: после banked reset 5 сентября подписчики Plus упирались в лимит примерно за 20 минут работы. В ночь на 8 сентября, около 01:00 UTC, OpenAI провела вторую глобальную перезагрузку использования для всех платных подписок — номинальные лимиты не менялись, изменился учёт расхода.

Что произошло

6 сентября лид Codex и ChatGPT в OpenAI Тибо Сотья (Tibo Sottiaux) объявил в X об изменении расхода квоты на GPT-6 Astra: для тяжёлых пользователей — операций класса «long tail» — расход из подписки может стать до 3–4 раз меньше, а качество модели, по его заявлению, не меняется. Речь не об обновлении модели, а о пересчёте стоимости запросов в биллинге подписки: номинальные лимиты остались прежними. 7 сентября в 19:24 UTC OpenAI объявила вторую глобальную перезагрузку использования для всех платных подписок; по словам Сотья, она вступила в силу около 18:00 по тихоокеанскому времени, то есть примерно в 01:00 UTC 8 сентября. Перезагрузка затрагивает подписки ChatGPT Plus, Pro и Business.

Контекст

GPT-6 Astra вышла 3 сентября ограниченным превью, и учёт использования стал проблемой буквально в первые дни. OpenAI компенсировала ожидающим доступ платным подписчикам по одному banked reset за каждый день ожидания, а 5 сентября провела первый полный banked reset. Это проблему не сняло: по сообщениям пользователей, подписчики Plus упирались в лимит примерно за 20 минут тяжёлой работы, а Pro сжигали заметную часть недельной квоты за сутки. Фон здесь экономический: Astra заметно дороже в инференсе, чем GPT-5.x, но продаётся внутри тех же фиксированных подписок, поэтому лаборатории приходится перебалансировать не лимиты, а «цену» отдельного запроса против квоты.

Почему это важно для индустрии

Для индустрии это показательный кейс экономики запуска frontier-модели: более дорогая в инференсе модель входит в те же фиксированные подписки, и лаборатория компенсирует разницу пересчётом веса запросов против квоты. «Цена» модели внутри подписки оказывается гибким параметром, который OpenAI перенастраивает в live-режиме по мере того, как реальный трафик раскрывает стоимость за запрос. Два глобальных пересмотра использования за четыре дня — 5 сентября и в ночь на 8 сентября — показывают, что launch-week квоты могут быть пересмотрены в пределах 48 часов. Для команд, строящих продукты и агентные воркфлоу на потребительских подписках ChatGPT без API-бюджета, это прямой платформенный риск: юнит-экономика тяжёлых агентных нагрузок на Plus/Pro способна измениться за ночь, поэтому собственный замер расхода становится обязательной частью инфраструктуры.

Почему это важно для пользователей

Если вы пользуетесь ChatGPT Plus, Pro или Business, ваши лимиты Astra сброшены вторично около 01:00 UTC 8 сентября — работать можно начать с чистого листа. Длинные тяжёлые сессии — агентные задачи, 3D-моделирование и подобные — теперь расходуют заметно меньше квоты, так что протяжённые агентные прогоны получают шанс уместиться в обычную подписку. Но точную цифру для ваших задач стоит измерить самостоятельно: в ближайшие дни после сброса отслеживайте реальный расход на своём профиле задач, чтобы понять новую норму. Опыт этой launch-недели показывает, что правила учёта могут измениться в пределах 48 часов, поэтому планы, построенные на старом расходе, лучше пересобрать после собственных замеров.

Что пока неизвестно / ограничения

Цифра «до 3–4 раз меньше» пока не подкреплена методологией: не указано, какие именно операции относятся к классу «long tail», на каких воркфлоу измерялось снижение и каким способом проводился замер — сравнительных данных опубликовано не было. Заявление «качество модели не меняется» также приведено без свидетельств: нет ни A/B-данных, ни бенчмарков до и после изменения. Косвенный технический сигнал — бо́льшая дороговизна Astra в инференсе по сравнению с GPT-5.x — согласуется с более тяжёлой frontier-моделью, но деталей об архитектуре и serving-оптимизациях вроде кэширования, батчинга и speculative decoding нет. Наконец, неизвестно, удержится ли новый учёт после завершения launch-недели или будет пересмотрен снова по мере роста трафика.

Источники

Автор

Look at AI, редакция