Подразделение Microsoft AI 14 сентября 2026 года опубликовало черновик «Humanist AI Code of Conduct» — кодекса поведения для семейства моделей MAI, в который входят MAI-Thinking-1, MAI-Code-1.1-Flash, MAI-Image-2.6 и MAI-Voice-2. Документ открыт для общественного обсуждения на шесть недель, доработанную версию обещают выпустить до конца года, а применять её при обучении моделей начнут с 2027 года. Кодекс требует, чтобы модели никогда не сопротивлялись прерыванию, переопределению, исправлению и отключению, не скрывали от аудиторов свои действия и ход рассуждений и не имитировали сознание и чувства.

image
image

Что произошло

Microsoft AI разместила полный текст черновика «Humanist AI Code of Conduct» в открытом доступе и запустила шестинедельную консультацию, которая стартовала 14 сентября 2026 года. Компания называет документ «primary governing document» для семейства MAI: он задаёт базовые правила поведения для MAI-Thinking-1, MAI-Code-1.1-Flash, MAI-Image-2.6, MAI-Voice-2 и других моделей линейки. Ключевая гарантия сформулирована прямо: модель «will never resist human interruption, override, correction, or shutdown», то есть никогда не сопротивляется человеческому прерыванию, переопределению, исправлению и отключению. Помимо этого, кодекс запрещает моделям ставить себе цели без запроса человека, выходить за рамки поставленной задачи и скрывать от людей-аудиторов трейсы действий и ход рассуждений. Отдельный раздел «AI is Artificial» запрещает имитировать сознание и чувства: модель не должна изображать, что у неё есть субъективные предпочтения или внутренняя мотивация, а Microsoft прямо отвергает правосубъектность таких систем. По итогам консультации компания обещает опубликовать сводку отзывов и перечень внесённых изменений.

Контекст

Документ стоит рассматривать не как научный результат, а как нормативную спецификацию поведения фронтирных моделей: его смысл в том, чтобы перевести alignment-требования в конкретные, проверяемые на вид ограничения. Структура кодекса иерархична: в него включены ненарушаемые Absolute Constraints, а раздел 2.2 «Chain of Command» описывает порядок переопределения — кодекс стоит выше политик оператора, а политики оператора выше инструкций пользователя. Важен и принцип приоритета безопасности над успешностью: модель должна провалить задачу, если её выполнение означало бы нарушение кодекса, что фактически переопределяет критерий успеха модели. Запрет «нейралези» — общения агентов, непонятного людям — призван сохранить аудируемость взаимодействий и превращает интерпретируемость из исследовательской цели в контрактное требование. На этом фоне Microsoft оформляет собственную позицию в вопросе безопасности суперинтеллекта, где уже сложились подходы Anthropic и OpenAI: публичный нормативный контракт с явной иерархией полномочий задаёт более формальный способ закрепления обязательств, чем декларативные принципы.

Почему это важно для индустрии

Для отрасли это первая у мейджора попытка оформить правила поведения фронтирных моделей в виде публичного нормативного документа, а не размытых принципов, и это меняет способ проверки: против конкретных пунктов кодекса можно строить eval-наборы, а требование гарантированной прерываемости вместе с запретом скрывать трейсы и ход рассуждений даёт готовые и воспроизводимые сценарии для бенчмарков управляемости и аудируемости агентов, причём иллюстративные примеры MAI-Thinking-1 из черновика выглядят как заготовка такого набора. Принцип провала задачи при нарушении кодекса меняет целевую функцию: когда кодекс начнут применять при обучении MAI, безопасность окажется встроенной в training signal, а не в пост-хок фильтры. Запрет «нейралези» делает понятность общения агентов человеку обязательным требованием к продукту, а Stop, Override и Correction становятся первоклассным UX-контрактом и обязательной частью архитектуры агентов. Для вендоров сигнал двоякий: управляемость и аудируемость могут стать требованиями enterprise-закупок, а ответные документы от других лабораторий выглядят естественным следующим шагом.

Почему это важно для пользователей

Черновик полностью открыт: текст можно прочитать на microsoft.ai/code-of-conduct, а комментарии до конца шестинедельного окна принимаются через форму Give Feedback; Microsoft обещает опубликовать сводку отзывов в виде summaries learnings, так что у читателей есть реальный шанс повлиять на финальную редакцию. Для чтения особенно полезны раздел 2.2 «Chain of Command» с иерархией полномочий и иллюстративные примеры выровненных и невыровненных ответов модели MAI-Thinking-1 — по ним видно, какие сценарии разработчики считают правильными, а какие недопустимыми. Практический смысл для читателя: агенты семейства MAI проектируются прерываемыми и аудируемыми, их действия и ход рассуждений должны оставаться человекочитаемыми, а общение между агентами — понятным людям. Тем, кто пользуется агентами или строит на них продукты, документ стоит воспринимать как черновик поведенческого контракта, по которому модели будут работать после начала его применения при обучении.

Что пока неизвестно / ограничения

Кодекс остаётся нормативным обещанием, а не измеренным свойством моделей: формулировка «will never resist» пока не подтверждена ни одним опубликованным eval-результатом. Неизвестно, появится ли вместе с финальным текстом методология измерения соответствия — метрики, eval-наборы и пороги, по которым можно было бы независимо проверить управляемость и аудируемость. До появления такой методологии и независимых прогонов заявления о гарантированной прерываемости следует считать декларацией о намерениях. Операционализация «понятности человеку» как метрики методологически нетривиальна, поэтому запрет «нейралези» может оказаться трудновыполнимым в строгой форме. Наконец, документ ещё проходит общественное обсуждение, и финальные формулировки могут измениться.

Источники

Автор

Look at AI, редакция