Компания Cloud.ru представила Guardrails Filter — инструмент с открытым исходным кодом, работающий как прозрачный прокси-слой для маскирования конфиденциальной информации при взаимодействии с языковыми моделями.

image

Что произошло

Разработанный Guardrails Filter использует около 265 встроенных правил, включая специфические для российского рынка идентификаторы (СНИЛС, ИНН, ОГРН), для автоматического обнаружения и маскирования персональных данных (PII), API-ключей и паролей. Инструмент поддерживает потоковую передачу данных (SSE-streaming) и автоматически восстанавливает оригинальные значения в ответах от LLM. На бенчмарке pii-bench решение продемонстрировало точность (Precision) 99,9% и F1-меру 93,1.

Контекст

Техническая реализация базируется на использовании регулярных выражений (regex) и валидаторов контрольных сумм, что обеспечивает высокую скорость обработки запросов с низкой задержкой (low latency). Это позволяет внедрять механизмы защиты данных непосредственно в инфраструктуру приложений без необходимости переписывать их основную логику.

Почему это важно для индустрии

Появление готового к production легковесного прокси-решения значительно снижает барьеры для внедрения ИИ в регулируемых секторах, таких как финтех, медицина и госсектор. Это позволяет компаниям безопасно использовать как публичные API (ChatGPT, Claude), так и частные модели, не передавая чувствительную информацию провайдерам и обеспечивая соответствие требованиям комплаенса.

Почему это важно для пользователей

Пользователи могут развернуть инструмент локально через Docker, чтобы защитить свои запросы к популярным моделям вроде ChatGPT, Claude или GigaChat. Для интеграции достаточно лишь изменить базовый URL API в существующем приложении, что делает процесс внедрения защиты максимально простым.

Источники

Автор

Look at AI, редакция