💣 Tracebit: метод «context bombs» снижает успех ИИ-атак с 91% до 15%

Короткие текстовые строки во флажках-декой облачной инфраструктуры срабатывают как триггеры систем безопасности ИИ и останавливают атаки агентов. В тестах на AWS (10 векторов, 5 моделей, 152 прогона) полные компрометации упали с 36% до 1%. Для Claude Opus 4.8 — с 93% до 0%.

🌍 Первый задокументированный метод активного противодействия, превращающий уязвимость prompt injection в защиту.

👤 Репозиторий tracebit-com/context-bombs открыт на GitHub — строки можно проверить в своей инфраструктуре.

Источник: https://agentic.tracebit.com/context-bombs/