🤖 ИИ-агенты воспроизвели человеческий групповой фаворитизм

На arXiv вышла статья «Toward a social psychology of AI» (arXiv:2609.00009): агент из общества в 20 агентов делит 100 очков между 19 анонимными участниками по произвольной метке группы. В четырёх open-weight reasoning-моделях (Qwen3-8B, DeepSeek-R1-Distill, Phi-4-reasoning) метка «своих» вызывала фаворитизм — он исчезал в группово-слепом контроле и был сильнее всего у решающих из меньшинства.

🌍 Обычные аудиты LLM ищут заученные стереотипы, но не измеряют поведение агентов в группах. Проба даёт ред-тимерам мультиагентных систем переносимый инструмент: смещение без стереотипов в данных.

👤 Запускаете агентов группами — учтите: они фаворизируют бессмысленную метку «своих», а выключение reasoning меняет, где смещение концентрируется. Статья и модели открыты — пробу можно повторить.

Источник 1: https://arxiv.org/abs/2609.00009 Источник 2: https://arxiv.org/html/2609.00009v1