🌞 Внедрение каталога данных После того, как определились с конкретным каталогом данных и развернули его, можно подумать как его внедрять в организации. Сегодня посмотрим на план внедрения.
📌 Определяем команду проекта Тут понадобятся некоторые из вот этих ребят. В целом понадобятся следующие роли: 🔸 Владелец проекта - для координации и управения процессом в целом; 🔸 Data Steward'ы для описания данных и проставления связей; 🔸 Специалисты (в зависимости от выбранного решения) для настройки подключения источников.
📌 Предварительная настройка каталога 🔸 Добавляем роли пользователей/владельцев; 🔸 Определяем привилегии ролей и раздаем права; 🔸 Создаем структуру доменов и глоссария.
📌 Составляем список источников В первую очередь логично подключить ключевые источники в организации, например, коммунальные хранилища. Затем можно заняться подключением остальных источников - операционных БД, API и т.д.
📌 Подключаем выбранные источники 🔸 Настраиваем само подключение к источникам и расписание загрузки; 🔸 Настраиваем фильтры для загрузки метаданных только по нужным объектам.
📌 Обогащаем метаданные Один из самых продолжительных по времени выполнения этапов. На данном этапе хорошо бы оценить, какой % данных у нас уже описан вместе с полученными метаданными из источника. Тут будет очень кстати, если наш каталог умеет считать различные метрики качества описания Далее: 🔸 приоритезируем источники и объекты в них и добавляем описание; 🔸 добавляем связи объектов и доменов; 🔸 создаем термины и связываем их с объектами физической модели данных; 🔸 присваиваем объектам теги.
📌 Обучение пользователей Параллельно с предыдущими этапами можно заняться подготовкой пользователей к эффективному использованию нашего каталога. 🔸 проводим обучения по поиску и заполнению данных; 🔸 встраиваем каталог в существующие процессы организации.
📌 Считаем метрики В ходе внедрения и по результатам, не забываем смотреть на метрики (говорили про них тут), чтобы оценить эффект от внедрения инструмента.
🤟 И по результатам можно переходить в режим, когда больше занимаемся поддержкой существующего объема метаданных в актуальном состоянии и периодического подключения новых источников.
В этом посте были ссылки, но мы их удалили по правилам Сетки