💣 Tracebit: метод «context bombs» снижает успех ИИ-атак с 91% до 15%
Короткие текстовые строки во флажках-декой облачной инфраструктуры срабатывают как триггеры систем безопасности ИИ и останавливают атаки агентов. В тестах на AWS (10 векторов, 5 моделей, 152 прогона) полные компрометации упали с 36% до 1%. Для Claude Opus 4.8 — с 93% до 0%.
🌍 Первый задокументированный метод активного противодействия, превращающий уязвимость prompt injection в защиту.
👤 Репозиторий tracebit-com/context-bombs открыт на GitHub — строки можно проверить в своей инфраструктуре.
Источник: https://agentic.tracebit.com/context-bombs/
