На All-In Summit в Лос-Анджелесе 14 сентября Илон Маск предложил превратить соперничество ИИ-лабораторий в механизм безопасности: перед публичным релизом разработчики получали бы доступ к общему test harness и проверяли бы модели конкурентов. По его словам, участвовать должны xAI, OpenAI, Anthropic, Google, Meta и три-четыре ведущие китайские компании. Пока предложение существует только в виде заявления: ни одна конкурентная лаборатория не согласилась участвовать, а прозвучало оно на фоне редкого единства лидеров отрасли вокруг замедления разработки передового ИИ.

image
image

Что произошло

Выступая на All-In Summit в Лос-Анджелесе в понедельник, 14 сентября, Илон Маск предложил, чтобы крупнейшие разработчики передовых ИИ-моделей перед публичным релизом передавали друг другу доступ к общему test harness — стандартному стенду для тестов — и проверяли модели соперников. По его замыслу, в схеме должны участвовать xAI, бизнес которого присоединён к SpaceX в феврале, OpenAI, Anthropic, Google, Meta и «три-четыре ведущих китайские компании». Маск признал, что метод не идеален, но заявил, что «шансы найти проблемы станут значительно больше», и выразил уверенность, что китайские компании, вероятно, согласятся на такую проверку.

Контекст

Предложение прозвучало на фоне заметного сдвига в публичном споре о безопасности передового ИИ. Дарио Амодеи выступил с эссе о паузе в разработке передовых моделей, и его поддержали Сэм Альтман и сам Маск — фигуры, обычно конкурирующие за один рынок; такого единства лидеров отрасли отмечали редко. Дискуссию обострил уход из Anthropic исследователя Джейкоба Коксона, заявившего, что лаборатории «ставят на кон наши жизни», а Эван Хабингер из Anthropic поддержал оценку, по которой риск гибели человечества от ИИ в течение десятилетия превышает 10 процентов. Политическое давление при этом идёт в обратную сторону: Трамп назвал тревоги об ИИ-безопасности «hoax» и «scam», а МИД Китая — «fear mongering». На этом фоне идея взаимной проверки выглядит как попытка найти механизм безопасности, который не требует ни государственного регулирования, ни добровольной остановки разработок.

Почему это важно для индустрии

Для отрасли суть предложения в том, что конкуренты превращаются в независимых red-team'еров: у соперника есть прямой стимул найти уязвимость, которую создатели модели пропустили, а внешние adversarial-проверки обычно эффективнее внутренних evals, где тесты и модель делает одна команда. Такой механизм стал бы альтернативой и государственному регулированию, и самоограничению, которое геополитическая гонка с Китаем делает политически сложным. Главный барьер экономический: до релиза предоставить лучшую модель конкурентам — значит раскрыть конкурентное преимущество, поэтому лаборатории, чей бизнес построен на закрытых frontier-моделях, скорее будут участвовать формально или откажутся вовсе. Если схема хотя бы в урезанном виде приживётся, на её основе может вырасти категория нейтральной тестовой инфраструктуры: общие протоколы evals, red-teaming, машиночитаемые отчёты об оценках, а для разработчиков frontier-моделей — постоянная статья расходов на safety-аудит.

Почему это важно для пользователей

Для читателя главное в том, что абстрактный спор «ИИ опасен, надо тормозить» впервые оформлен в виде конкретного рабочего механизма с участием компаний, чьими моделями люди пользуются каждый день. Если взаимные проверки перед релизом станут нормой, новые модели будут выходить реже, но с меньшим числом непроверенных уязвимостей, то есть между скоростью появления функций и их надёжностью придётся выбирать. Отслеживать стоит конкретные индикаторы: официальные ответы OpenAI, Anthropic, Google, Meta и xAI на предложение Маска, появление пилотных внешних оценок и публикация отчётов об оценках до релиза моделей. Если хотя бы одна крупная лаборатория согласится на внешнюю проверку, это будет сигналом реального изменения политики безопасности, а не только риторики.

Что пока неизвестно / ограничения

Предложение существует пока в виде публичного заявления: нет ни методологии, ни спецификации test harness, ни критериев, по которым модель считается пройденной проверку. Неизвестно, к какой версии модели даётся доступ — к снимку, API или весам, — и как будут верифицироваться и публиковаться найденные проблемы. Ни одна конкурентная лаборатория пока не согласилась участвовать. Заявление Маска о том, что Китай, вероятно, согласится, — это его личная оценка: согласия китайских компаний не приведено, а МИД Китая ранее назвал тревоги об ИИ-безопасности «fear mongering».

Источники

Автор

Look at AI, редакция