🤖 LLM-агенты против заводских ПЛК: успех лишь у трети попыток

Группа из Chongqing University и Zhejiang University 27 августа опубликовала препринт arXiv 2608.26882 — первый бенчмарк автономных LLM-агентов на реальных ПЛК в режиме hardware-in-the-loop: 4 контроллера, 4 нагрузки, 5 семейств LLM. Лишь 75 попыток из 240 (31,3%) достигли устойчивого физического воздействия.

🌍 Бенчмарк локализует этап срыва: чтение → запись → удержание эффекта. Наблюдаемость процесса — рычаг риска: успех после записи растёт с 44,2% до 64,0%. Для вендоров ПЛК это точки оценки защит: ограничение телеметрии, детектирование vendor-native записи.

👤 Сегодняшние агенты против заводского железа чаще всего срываются до первой легитимной операции чтения. Код и софт-конвейер воспроизведения открыты — бенчмарк можно повторить без промышленного стенда.

Источник 1: https://arxiv.org/abs/2608.26882 Источник 2: https://arxiv.org/pdf/2608.26882