Cloud.ru открыл код защиты данных для ИИ

Cloud.ru открыл исходный код Guardrails Filter — инструмента, который помогает компаниям защищать персональные и конфиденциальные данные при работе с большими языковыми моделями. Российские компании смогут бесплатно развернуть сервис в собственной инфраструктуре и использовать его с ИИ-моделями любых провайдеров, рассказал Cloud.ru со ссылкой на гендиректора компании Михаила Лобоцкого.
«Спрос на генеративный ИИ быстро растет, но требования к безопасности по-прежнему остаются одним из главных барьеров для его внедрения. Guardrails Filter создавался как часть нашей собственной ИИ-платформы именно для таких сценариев. Теперь мы открываем исходный код проекта, чтобы компании могли быстрее построить безопасную инфраструктуру для работы с языковыми моделями в собственном ИТ-контуре», — рассказал Лобоцкий.
Guardrails Filter уже используется в цифровой среде AI Factory для защиты запросов к сервису Foundation Models. Инструмент применяют в пилотных и коммерческих проектах клиентов, а также во внутренних проектах Cloud.ru.
Открытая версия не привязана к платформе Cloud.ru и может работать с любыми языковыми моделями. Компании смогут развернуть Guardrails Filter внутри собственной инфраструктуры, управлять сервисом через личный кабинет, настраивать правила защиты, тестировать их, а также просматривать логи и уведомления о событиях безопасности.
Инструмент работает между корпоративным приложением и ИИ-моделью. Он автоматически проверяет запросы пользователей и ответы модели на наличие чувствительных данных. Перед отправкой запроса сервис заменяет персональные данные, API-ключи, пароли и другую конфиденциальную информацию синтетическими значениями, а после получения ответа восстанавливает исходные данные.
Таким образом пользователи получают корректный результат от ИИ-модели, но реальные чувствительные данные не передаются внешней системе. Это особенно важно для компаний, которые хотят использовать генеративный ИИ, но должны соблюдать требования безопасности и защиты информации.
В опенсорс-версии доступны стандартные правила обнаружения чувствительных данных, а также возможность создавать собственные правила. Например, компании смогут настроить фильтры для внутренних номеров договоров, идентификаторов клиентов или кодовых названий проектов.
В сервис также добавили журналирование событий безопасности и тестовый режим Ghost Mode. Он позволяет проверить работу инструмента до включения полноценной защиты и понять, какие данные сервис будет считать чувствительными.
По данным Cloud.ru, качество работы Guardrails Filter подтверждено на публичном бенчмарке pii-bench. Инструмент набрал 93,1 балла по метрике F1, а точность срабатываний достигла 99,9%. Это означает, что сервис почти не принимает обычный текст за конфиденциальную информацию и в большинстве случаев корректно определяет чувствительные данные.
Исходный код Guardrails Filter в версиях Standalone и ExtProc доступен на GitHub и GitVerse.
Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.