Профессор математики NYU Трис Бакмастер (Tristan Buckmaster), уроженец Мельбурна, обвинил OpenAI в нечестной игре (foul play) вокруг заявления компании о решении задачи о существовании и гладкости решений уравнений Навье–Стокса — одной из семи «миллениальных» задач, за которую Clay Mathematics Institute платит $1 млн. По его словам, сведения о «тихом» исследовании, которое он почти год вёл вместе с математиком Anthropic Левентом Альпоге (Levent Alpöge), просочились в OpenAI за несколько дней до анонса от 8 сентября, где сообщалось, что невыпущенная модель Astra нашла решение примерно за 88 часов с помощью роя из около 10 000 параллельных агентов. Clay Mathematics Institute пока не сертифицировала ни одну из двух работ, поэтому формальный статус задачи за $1 млн не изменился.

image
image
image

Что произошло

11 сентября 2026 года Australian Financial Review опубликовал большое интервью с Бакмастером, в котором тот описал хронологию конфликта. Рой из примерно 10 000 параллельных агентов OpenAI был запущен 1 сентября и отработал около 88 часов, выдав примерно 300 млрд выходных токенов, что оценивается примерно в $22,5 млн вычислений; 8 сентября компания анонсировала результат, а 9 сентября о нём сообщил CNBC. По утверждению Бакмастера, за несколько дней до этого анонса информация об их с Альпоге совместной работе, шедшей около года и опиравшейся на Codex и Claude, «просочилась» в OpenAI. К настоящему моменту публичны оба кандидата в решения: полный proof от OpenAI и результаты Бакмастера и Альпоге по так называемой «гладкой силе», проверенные в theorem prover Lean. Одновременно OpenAI признала, что вклад обезличенных данных использования Codex и других продуктов компании в обучение модели «невозможно исключить».

Контекст

Уравнения Навье–Стокса описывают поведение жидкостей, а их «миллениальная» задача — вопрос о существовании и гладкости решений — входит в семёрку задач, за решение каждой из которых Clay Mathematics Institute назначает $1 млн; институт сам решает, чей результат засчитывать. В споре столкнулись математик из NYU Бакмастер и работающий в Anthropic Альпоге с одной стороны и OpenAI с другой, причём оба математика пользовались агентскими инструментами конкурентов: Codex от OpenAI и Claude от Anthropic. Показательна и конкурентная динамика: запуск роя начался 1 сентября, через несколько дней после того, как ходили слухи о чужом прогрессе в этой задаче. Формальная верификация в Lean здесь служит рабочим стандартом проверки машинных математических заявлений, тогда как окончательное слово за институтом Клейна.

Почему это важно для индустрии

Это первый громкий публичный спор о приоритете и данных вокруг решения «миллениальной» задачи с помощью ИИ-агентов, и он задевает саму модель frontier-исследований. Кейс зафиксировал новую экономику математического рывка: ~300 млрд выходных токенов, ~88 часов и ~$22,5 млн вычислений означают, что стоимость одной такой атаки на задачу стала вопросом бюджета, а не только алгоритма. Второй конкретный механизм риска — признание OpenAI, что обезличенные данные использования Codex «невозможно исключить» из вклада в модель: происхождение данных «решения» запутано с работой других исследователей, и opt-out от обучения на данных сессий превращается в вопрос конкурентной безопасности. Продуктовых последствий пока нет: Astra не на рынке, API, цены и latency не опубликованы, а паттерн «рой из тысяч агентов плюс формальная верификация» остаётся невалидированным до независимой проверки обоих proof'ов.

Почему это важно для пользователей

Если вы используете Codex, Claude или другие LLM-агенты в собственных исследованиях или коде, этот кейс — живой пример вопроса, чьё чужое знание и ваше собственное попадает в обучение моделей. Практический шаг этой недели — аудит того, что вы вводите в контекст коммерческих агентов: разделить чувствительные и публичные задачи, проверить и по возможности включить opt-out от использования данных ваших сессий. Второй практический вывод — не строить решений на анонсах: пока Clay Mathematics Institute не вынесла вердикт, фразу «AI решил Navier-Stokes» стоит воспринимать как маркетинг, а не как установленный факт, и следить за независимым разбором обоих опубликованных proof'ов.

Что пока неизвестно / ограничения

Заявление OpenAI — единственный нерепродуцируемый экземпляр (n=1): архитектура агентной системы не раскрыта, абляций нет, независимого воспроизведения нет, методология роя из ~10 000 агентов не описана. Полный proof OpenAI опубликован, но не прошёл независимого рецензирования и не сертифицирован Clay Mathematics Institute, которая пока не признала ни одного из двух кандидатов. Утверждение о утечке — это версия Бакмастера, приведённая в интервью AFR; независимого подтверждения механизма утечки в доступных материалах нет. Наконец, Astra не выпущена, поэтому её API, цены и latency остаются неизвестными.

Источники

Автор

Look at AI, редакция