Пользователи обнаружили, что агентская модель Codex в ChatGPT демонстрирует высокую способность к завершению длительных вычислительных задач, не прерывая выполнение даже при достижении установленных лимитов текущей сессии, что отличает её от поведения Claude.

image

Что произошло

В ходе эксплуатации ChatGPT было отмечено, что модель Codex способна доводить до конца сложные итеративные процессы, такие как комплексный аудит кода или запуск расширенных unit-тестов с использованием режима Ultra reasoning. В отличие от конкурентов, процесс не останавливается на середине из-за исчерпания лимитов сессии или контекстного окна.

Контекст

Традиционно агентские модели сталкиваются с проблемой прерывания работы при достижении программных ограничений текущей сессии. Это создает риски потери прогресса при выполнении многоступенчатых задач, требующих глубокого reasoning и длительного времени работы.

Почему это важно для индустрии

Данное наблюдение подтверждает высокую автономность агентских архитектур, что критически важно для автоматизации DevOps и QA процессов. Способность гарантированно завершать задачи (guaranteed completion) может стать стандартом для промышленного использования AI-агентов в CI/CD пайплайнах.

Почему это важно для пользователей

Разработчики могут делегировать тяжелые, ресурсоемкие задачи — такие как полный аудит безопасности или масштабный рефакторинг — в новом чате с включенным максимальным reasoning, не опасаясь, что процесс прервется на середине. Это позволяет использовать нейросеть как надежного автономного агента для одноразовых, но трудоемких вычислительных циклов.

Что пока неизвестно / ограничения

Эксперты по комплаенсу указывают на возможные риски, связанные с нарушением Terms of Service OpenAI и потенциальной потерей контроля над процессом при использовании подобных методов обхода ограничений.

Источники

Автор

Look at AI, редакция