Как логи отладки AI-агента стали базой медицинских данных — и что с этим делать
Автор добавил систему мониторинга в клинический AI-агент и обнаружил, что трейсы содержат незащищённые персональные медицинские данные (PHI). Стандартное решение — редактирование перед экспортом — оказалось сложнее, чем кажется: даже с библиотекой Presidio от Microsoft детектор пропустил 135 из 752 PHI-сущностей на тестовом наборе.
Обязательно для разработчиков медицинских AI-систем: показывает реальные масштабы утечки PHI через инструменты мониторинга и ограничения стандартных решений редактирования.
Это аннотация к авторской статье. Мы не публикуем и не пересказываем чужие тексты целиком — полная версия у автора.
О чём статья
- Системы observability для медицинских AI незаметно становятся базами персональных данных, которые никто не оценивал с точки зрения безопасности
- Библиотека Presidio пропускала PHI в 135 случаях из 752 (позже удалось снизить до 17), но главная проблема глубже
- Редактирование текста записи не равно редактированию трейса — одни и те же данные пациента появляются в разных частях логов
Елена Верещагина
Medium #llm
Читать оригинал
Комментарии