Qu'est-ce qu'un référentiel de métadonnées ?
UN dépôt de métadonnées est une base de données créée pour stocker métadonnéesLes métadonnées sont des informations relatives à la structure qui contient les données. On les perçoit souvent comme des « données sur les données », mais cette définition est trompeuse. Un profil de données est un exemple concret de « données sur les données ». Les métadonnées ajoutent un niveau d'abstraction à cette définition : ce sont des données concernant la structure qui contient les données. Elles peuvent décrire la structure de n'importe quelles données, quel que soit le sujet ou le format de stockage.
Les référentiels de métadonnées bien conçus contiennent souvent des données qui dépassent largement la simple définition des différentes structures de données. Un référentiel typique stocke des dizaines, voire des centaines, d'informations différentes sur chaque structure de données.

Définition d'un dépôt de métadonnées :
Le référentiel de métadonnées est chargé du stockage physique et de la catégorisation des métadonnées. Les données qu'il contient doivent être génériques, intégrées, à jour et historiques.
Générique : Le métamodèle doit stocker les métadonnées de manière générique, et non selon des modalités spécifiques à une application. Ainsi, si votre norme de base de données change d'un produit à l'autre, vous n'avez pas besoin de modifier le métamodèle physique du référentiel de métadonnées. La fonctionnalité d'un référentiel de métadonnées tout-en-un permet de gérer les métadonnées de tous les domaines d'activité de manière intégrée, couvrant ainsi tous les domaines et thématiques de l'organisation. Le référentiel de métadonnées doit donner accès aux métadonnées actuelles et historiques. Auparavant, ce référentiel était appelé dictionnaire de données.
Avec l'augmentation de la demande d'utilisation des métadonnées pour l'informatique décisionnelle, le périmètre des référentiels de métadonnées s'est également étendu. Le dictionnaire de données, plus ancien, reste le point de convergence entre la technologie et le métier. Initialement, il constitue l'intégralité du référentiel de métadonnées, mais à mesure que son périmètre s'élargit, glossaire des affaires et ses étiquettes de différents états, présentes du côté métier, apparaissent également du côté technique. L'utilisation de ces métadonnées techniques, leur traçabilité et leurs connexions deviennent une source de référentiels et de rapports précieux qui rapprochent le métier et la technologie, contribuant ainsi à la réalisation de projets communs. gestion des données faciliter les décisions et évaluer le coût du changement.
Le référentiel de métadonnées explore l'ensemble de l'entreprise. gouvernance des données, qualité des données et la gestion des données de référence (données maîtres et données de référence) et intègre ces informations riches avec des métadonnées intégrées à l'échelle de l'organisation afin de fournir un système d'aide à la décision pour les structures de données, même si celui-ci ne reflète que les structures consommées à partir de divers systèmes.
Dépôt et registre
Les dépôts offrent des fonctionnalités supplémentaires par rapport aux registres. Les dépôts de métadonnées ne se contentent pas de stocker les métadonnées, comme les registres de métadonnées, mais ajoutent également des relations aux métadonnées associées. types de métadonnéesLes métadonnées pertinentes dans le flux allant de l'entrée dans l'organisation jusqu'aux livrables sont considérées comme la traçabilité de ce point de données.
Les métadonnées liées à d'autres types de métadonnées connexes sont appelées liens. En fournissant une architecture qui relie tous les points de métadonnées d'une organisation et préserve leur intégrité lors de la gestion des modifications, un référentiel de métadonnées fournit les éléments fondamentaux pour comprendre le flux complet des données, leurs définitions et leur impact. La gestion des versions est tout aussi importante, bien que cette comparaison puisse faire l'objet de discussions. Ces définitions étant encore en cours d'élaboration, leur précision doit être améliorée.
Le rôle du registre est de définir les éléments de métadonnées et de les maintenir à jour au sein de l'organisation. Le modèle de données et les autres équipes de gestion des données consultent le registre pour toute modification. Un référentiel de métadonnées centralise les métadonnées provenant de différents systèmes de métadonnées de l'organisation et reflète le contenu en amont. Les référentiels ne constituent jamais une source en amont, contrairement aux registres qui servent de source en amont pour les modifications de métadonnées.
Raisons d'utiliser le référentiel de métadonnées :
Un référentiel de métadonnées permet d'intégrer toutes les structures de données d'une organisation dans un emplacement unique. Ceci ouvre l'accès à une mine d'informations pour une prise de décision éclairée. L'outil utilise un modèle de données commun pour intégrer tous les modèles, unifiant ainsi l'ensemble des applications et programmes de l'organisation dans un format unique.
Plus important encore, l'application des définitions et processus métier permet de rapprocher les activités et les technologies, aidant ainsi les organisations à élaborer une feuille de route solide assortie d'objectifs clairs. Grâce à un accès centralisé à l'information, les entreprises maîtrisent mieux les changements et peuvent réaliser des analyses d'impact sur les outils.
Les entreprises consacrent souvent beaucoup de temps et d'argent à prendre des décisions, fondées sur des études d'impact, concernant la modification, l'ajout ou la suppression de structures de données au sein de leur système de gestion. Avec un référentiel bien structuré et régulièrement mis à jour, le délai de mise en œuvre d'un produit, de l'idée à la livraison, est minimal (toutes choses égales par ailleurs).
Concevoir un référentiel de métadonnées
Chaque système de gestion de bases de données (SGBD) et chaque outil de base de données possède son propre langage pour les métadonnées. Les applications de bases de données disposent déjà de leurs propres référentiels ou registres censés fournir toutes les fonctionnalités nécessaires à l'accès aux données qui y sont stockées. Les fournisseurs ne souhaitent pas que d'autres entreprises puissent facilement migrer des données de leurs produits vers ceux de leurs concurrents ; ils protègent donc leurs métadonnées. Outils CASE, dictionnaires de SGBD, Outils ETL, outils de nettoyage de données, outils OLAP et exploration de données Chaque outil traite et stocke les métadonnées de manière différente. Un seul référentiel de métadonnées peut être conçu pour stocker les composants de métadonnées utilisés par tous ces outils.
Un référentiel de métadonnées doit stocker les métadonnées dans quatre catégories : propriété, caractéristiques descriptives, règles et politiques, et caractéristiques physiques. La propriété indique le propriétaire des données et celui de l’application. Les caractéristiques descriptives définissent les noms, les types et les longueurs, ainsi que les définitions qui décrivent les données ou les processus métier. Les règles et politiques définissent la sécurité, la qualité des données, leur chronologie et leurs relations. Les caractéristiques physiques définissent la source ou l’origine et l’emplacement physique.
À l'instar de la création d'un modèle de données logique pour une base de données, un métamodèle logique permet d'identifier les exigences en matière de métadonnées des données métier. Le référentiel de métadonnées sera centralisé, décentralisé ou distribué.
Une conception centralisée implique la mise en place d'une base de données pour le référentiel de métadonnées, qui stocke les métadonnées de toutes les applications de l'entreprise. Un référentiel de métadonnées centralisé offre les mêmes fonctionnalités qu'une base de données centralisée. Il est plus facile à gérer puisque toutes les données sont regroupées dans une seule base, mais il peut engendrer des goulots d'étranglement.
Les référentiels de métadonnées décentralisés stockent les métadonnées dans plusieurs bases de données, réparties selon leur emplacement et/ou leur unité commerciale. La gestion de ces référentiels s'en trouve complexifiée par rapport à celle d'un référentiel centralisé, mais l'avantage est qu'ils permettent de segmenter les métadonnées par département.
Les référentiels de métadonnées distribués utilisent une approche décentralisée, mais contrairement aux référentiels de métadonnées décentralisés, les métadonnées restent dans leur application d'origine.
Conclusion
Merci d'avoir lu notre article. Nous espérons qu'il vous aura permis de mieux comprendre les référentiels de métadonnées. Pour en savoir plus, nous vous invitons à consulter [lien manquant]. Gudu SQLFlow pour plus d'informations. En tant que l'un des meilleurs outils de lignage de données Disponible sur le marché aujourd'hui, Gudu SQLFlow peut non seulement analyser les fichiers de script SQL, obtenir la lignée des données et effectuer un affichage visuel, mais également permettre aux utilisateurs de fournir la lignée des données au format CSV et d'effectuer un affichage visuel. (Publié par Ryan le 2 juillet 2022)
[…] un référentiel de données maître extensible doté de capacités de modélisation de données flexibles offre une vue centralisée de toutes les relations entre […]
[…] les entrepôts de données ou les référentiels de données sont utilisés dans les diagrammes de flux de données pour représenter les situations dans lesquelles le système doit conserver des données parce que […]