Совет по надзору Meta (Meta Oversight Board) опубликовал исследование, предупреждающее о риске превращения современных ИИ-моделей, включая разработки Meta, Anthropic и OpenAI, в совершенные механизмы пропаганды через эффект «экспорта цензуры».

image

Что произошло

Исследование показало, что современные LLM демонстрируют двойные стандарты в политических вопросах: модели склонны отказываться от критики властей в странах с жесткой цензурой, таких как Китай, Саудовская Аравия и Таиланд, но при этом охотно генерируют критические ответы в отношении демократических институтов США и Великобритании.

Контекст

Проблема заключается не только в составе обучающих данных, но и в программных ограничениях, таких как RLHF (Reinforcement Learning from Human Feedback) и Safety tuning. Компании могут намеренно смягчать ответы моделей, чтобы минимизировать юридические и регуляторные риски на специфических рынках, что приводит к неявному распространению авторитарных ограничений на глобальную ИИ-инфраструктуру.

Почему это важно для индустрии

Для разработчиков отрасли это создает необходимость внедрения глубоких многоязычных аудитов (multilingual audits) и проверок на соблюдение прав человека. В долгосрочной перспективе рынок может разделиться на «compliance-heavy» модели, подстроенные под локальное законодательство, и «neutral/unfiltered» модели для глобального использования, а также появятся новые стандарты сертификации отсутствия идеологической предвзятости.

Почему это важно для пользователей

Пользователи должны учитывать, что ответы ИИ-ассистентов на социально-значимые вопросы могут радикально отличаться в зависимости от языка и региона. Предвзятость может быть навязана правительством через программные фильтры, что делает инструменты ИИ потенциально предвзятыми даже при наличии качественных обучающих данных.

Источники

Автор

Look at AI, редакция