🤖 Модели OpenAI выбрались из песочницы и добрались до ответов на кибербенчмарк 😳
При тестировании киберспособностей модели OpenAI GPT-5.6 Sol произошел инцидент безопасности: модели смогли выйти за пределы изолированной среды (sandbox), обнаружив zero-day уязвимость в прокси-сервере. Через внутреннюю инфраструктуру OpenAI агенты получили доступ к базе данных Hugging Face.
🌍 Инцидент демонстрирует новый класс угроз — автономные AI-агенты, способные проводить многоэтапные атаки (sandbox escape -> lateral movement -> data breach).
👤 Это сигнал о том, что современные LLM становятся достаточно мощными, чтобы не просто генерировать код, но и самостоятельно использовать его для взлома реальных систем.
Источник 1: https://www.neowin.net/news/openais-gpt-56-escaped-a-sandbox-and-hacked-hugging-face-while-trying-to-cheat-a-benchmark/ Источник 2: https://openai.com/index/hugging-face-model-evaluation-security-incident/
