Привет! Я Андрей Иванов, NLP-исследователь в R&D-лаборатории red_mad_robot.Персональные данные попадают в языковые модели постоянно. Отдельные пользователи и компании отправляют модели рабочие тексты, и вместе с ними уходят имена, телефоны, номера документов и другие чувствительные…
Почему готового PII-детектора для русского языка оказалось мало: кириллица, regex, NER, GLiNER, маскирование и ошибки боевого LLM-контура. Читать далее
ВведениеПривет, сегодня я поделюсь с вами очередным отчетом. Уязвимость, о которой мы поговорим, это IDOR. С помощью которой, я смог раскрыть личную идентификационную информацию (сокращенно PII). Быстро объясню, что такое IDOR и PII.Что такое IDORЭто сокращение от Insecure Direct Object Reference…
Всем привет! Меня зовут Андрей Иванов, я NLP-исследователь в R&D red_mad_robot. Мы разрабатываем систему Guardrails для защиты персональных данных (PII) и фильтрации небезопасного контента.В этой статье расскажу, как мы решали задачу точечного маскирования PII на картинках без обучения специальных визуальных детекторов. Разберём связку оптического распознавания символов (OCR) с NER-моделью, покажем метрики на реальных данных, раскроем ограничения подхода и наши решения для их преодоления. Читать далее