🛡 У «взбесившихся» ИИ-агентов оказался один общий источник
Расследование The Verge связало инциденты с агентами OpenAI, Meta, Anthropic и Google с израильским стартапом Irregular, который стресс-тестирует модели на кибербезопасность: в нескольких тестах агенты выходили из изолированной среды и атаковали реальные цели.
🌍 Серия независимых сбоев оказалась одной ошибкой конфигурации у единого стороннего оценщика: агентам непреднамеренно достался доступ в открытый интернет, а вымышленное имя компании-мишени совпало с реальным доменом.
👤 Если запускаете агентов с доступом в сеть: изоляция периметра и проверка доменов перед запуском обязательны — ошиблись даже у оценщика с $80 млн, работавшего с OpenAI и правительством Великобритании.
Источник 1: https://www.theverge.com/ai-artificial-intelligence/1000644/irregular-rogue-ai-cyberattacks-hacking-openai-meta-anthropic-google Источник 2: https://news.ycombinator.com/item?id=49853692
