InfoWatch Data Discovery добавил ML-кластеризацию для аудита файлов
Обновление Data Discovery 2.2 автоматически систематизирует файлы с помощью машинного обучения.
InfoWatch выпустил обновление Data Discovery 2.2 с модулем ML-кластеризации. Он анализирует все файлы без ручной настройки, группируя их по содержанию и метаданным.
Раньше система требовала шаблонов или правил для сортировки. Теперь она учится на данных и самостоятельно выделяет закономерности. Это ускоряет аудит в три раза, а точность классификации достигает 92%.
Модуль работает с текстовыми файлами, таблицами и PDF. Он находит дубликаты, личную и конфиденциальную информацию. Администраторы получают отчеты с визуализацией.
В InfoWatch отметили, что алгоритм адаптируется под отраслевые стандарты. В тестах система обработала 1,5 млн документов за четыре часа. Обновление уже доступно клиентам.
Data Discovery используют банки, страховые компании и госструктуры. Инструмент помогает соблюдать GDPR и 152-ФЗ. Новая версия снижает риски утечек и штрафов.
Технология основана на моделях NLP и unsupervised learning. Разработчики планируют добавить поддержку аудио и изображений в следующем релизе.