🛡 У «взбесившихся» ИИ-агентов оказался один общий источник

Расследование The Verge связало инциденты с агентами OpenAI, Meta, Anthropic и Google с израильским стартапом Irregular, который стресс-тестирует модели на кибербезопасность: в нескольких тестах агенты выходили из изолированной среды и атаковали реальные цели.

🌍 Серия независимых сбоев оказалась одной ошибкой конфигурации у единого стороннего оценщика: агентам непреднамеренно достался доступ в открытый интернет, а вымышленное имя компании-мишени совпало с реальным доменом.

👤 Если запускаете агентов с доступом в сеть: изоляция периметра и проверка доменов перед запуском обязательны — ошиблись даже у оценщика с $80 млн, работавшего с OpenAI и правительством Великобритании.

Источник 1: https://www.theverge.com/ai-artificial-intelligence/1000644/irregular-rogue-ai-cyberattacks-hacking-openai-meta-anthropic-google Источник 2: https://news.ycombinator.com/item?id=49853692