OpenAI открыла 1M-контекстное окно модели GPT-5.6 Sol в Codex для пользователей с ChatGPT-аккаунтами. Ранее окно в 1 050 000 токенов было доступно в Codex только через API-ключи. Дефолтное эффективное окно по-прежнему составляет 272 000 токенов, но расширить его можно несколькими строками в локальной конфигурации.


Что произошло
Объявление появилось 17 августа 2026 в посте в X от инженера OpenAI Tibo Sottiaux (@thsottiaux), который работает над Codex и ChatGPT: по его словам, 1M-контекст GPT-5.6 Sol в Codex теперь работает и при использовании через ChatGPT-аккаунты. Расширение включается как модельный оверрайт: в локальной конфигурации Codex задаются значения ключей model_context_window и model_auto_compact_token_limit, оба описаны в официальной справке по конфигурации. Порог авто-компакта в 900 000 токенов оставляет примерно 100 000 токенов запаса под системный контекст до того, как начнётся суммаризация истории.
Контекст
Модель GPT-5.6 Sol заявлена с контекстным окном 1 050 000 токенов, но в Codex эффективное окно по умолчанию ограничено 272 000 входными токенами, и этот лимит зафиксирован в метаданных Codex CLI v0.144.6. OpenAI сознательно не включает полное окно всем пользователям по умолчанию, чтобы не раздувать стоимость инференса и задержки ответов. В агентном кодинге при исчерпании эффективного окна срабатывает компакт, то есть суммаризация истории сессии, при которой часть деталей контекста теряется. Именно поэтому для длинных сессий дефолтное окно вынуждает модель чаще переходить к компакции, чем это необходимо.
Почему это важно для индустрии
Для отрасли это сдвиг платформы, а не обновление фичи: OpenAI переносит 1M-контекст GPT-5.6 Sol из API-эксклюзива в стандартную возможность Codex, и длинный контекст становится массовым ожиданием в агентном кодинге. Сам механизм модельного оверрайта показывает, как OpenAI делает длинный контекст опциональным рычагом: базовое окно остаётся компактным, расширенный контекст включается явным opt-in и привязывается к повышенной цене и затратам. Для продакт-билдеров 1M-окно превращается из задачи API-интеграции в настраиваемый параметр инструмента, а конкурентный задел в агентном кодинге смещается от умения держать весь контекст к оркестрации работы внутри окна.
Почему это важно для пользователей
Если вы работаете в Codex с GPT-5.6 Sol, расширить контекст можно прямо сейчас: три строки в ~/.codex/config.toml — model = "gpt-5.6-sol", model_context_window = 1000000 и model_auto_compact_token_limit = 900000 — или те же значения через флаги -c для одной сессии. Для длинных агентных сессий это означает меньше событий компакции истории и возможность вталкивать в контекст существенно больше кода, включая целые репозитории. Для большинства пользователей дефолтное окно не меняется, поэтому стоимость и задержки в базовых сценариях остаются прежними.
Что пока неизвестно / ограничения
Заявленное окно 1 050 000 токенов — продуктовое утверждение: в доступных материалах нет ни одной статьи, бенчмарка или сравнения поведения GPT-5.6 Sol при 272 000 и 1 000 000 токенов, а величина выигрыша в качестве не измерена. Утверждение, что токены за пределами дефолтного окна считаются с коэффициентом x2, исходит от сообщества и в объявлении OpenAI не подтверждено. По данным explainx.ai, на части подписочных планов эффективный потолок может не достигать 1M. Номинальное окно не равно бесплатной памяти: даже с максимальным контекстом длинная сессия на пороге 900 000 токенов всё равно проходит суммаризацию, а потери при компакции источниками не оцениваются.
Источники
- Пост Tibo Sottiaux (@thsottiaux) в X
- OpenAI Codex Configuration Reference
- Блог explainx.ai: Enable a 1M-Token Context Window in Codex CLI (GPT-5.6 Sol)
Автор
Look at AI, редакция
