3. Extraction des sources
Les entrepôts de données sont alimentés à partir de sources multiples, autonomes (gérées par des systèmes différents et indépendants), hétérogènes (du point de vue structurel ou sémantique), éventuellement peu structurées (données semi-structurées) ou non.
Une première démarche pour construire un entrepôt à partir de telles sources consiste à écrire pour chacune un programme
ad hoc
réalisant la sélection des données pertinentes de la source pour les adapter aux exigences du système qui gère l’entrepôt de données. Cette démarche est particulièrement contraignante notamment pour le rafraîchissement de l’entrepôt ainsi que pour s’adapter à ses évolutions.
Une démarche intermédiaire pour s'accorder avec plus de souplesse à l’hétérogénéité des systèmes qui gèrent les sources tout en préservant leur autonomie,...
Cet article est réservé aux abonnés
Cet article est réservé aux abonnés. Il vous reste 92 % à découvrir.
Déjà abonné ?
Se connecter
Lecture en cours
Extraction des sources