Ceci nous amène à la problématique d’intégration des données. Les données proviennent généralement de nombreuses sources de l’entreprise voire de l’extérieur de l’entreprise. Elles sont très souvent hétérogènes, possèdent leurs propres règles, leurs propres formats et chacune a ses défauts. Il arrive qu’une source de données
La problématique
ne soit pas fiable.
Un processus mal maîtrisé, comme un fichier manquant une fois sur deux ; un outil vieillissant qui travaille avec des formats non standard ; une fusion d’entreprises qui n’ont pas les mêmes références ; il y a de nombreux cas pour lesquels on ne peut pas faire confiance intégralement aux données qui vont être injectées dans notre DataWarehouse.
Il faut donc gérer des problèmes de qualité des données. Un des problèmes de qualité des données les plus courants est la gestion des données manquantes et ce sera ce point précis que nous allons détailler. Pour illustrer ce problème, nous allons prendre un exemple simple. Notre solution analyse des ventes ; nous prendrons la base de données d’exemple de Microsoft Adventure Works.
Nous allons étudier le cas où une vente n’est pas associée à un produit du catalogue. Dans notre scénario, notre processus d’intégration consolide les ventes des différents magasins et s’appuie sur un catalogue central de produits. Il peut arriver qu’une vente ne corresponde à aucun article de notre système central d’analyse des ventes. Voir figure 1.
Nous allons voir les différents moyens de gérer cela. Les solutions seront abordées d’un point de vue technique avec l’offre décisionnelle de Microsoft, basée sur SQL Server. Mais nous aurons aussi une approche plus méthodologique, pour traiter le problème de fond.
Téléchargez cette ressource
Plan de sécurité Microsoft 365
Les attaquants savent comment prendre le contrôle de votre tenant Microsoft 365, et vous, savez-vous comment le reprendre en main ?
Les articles les plus consultés
Les plus consultés sur iTPro.fr
- IA & pilotage de portefeuille de projets : accélérer la décision sans en perdre le contrôle
- Analyse Patch Tuesday Juin 2026
- La bataille de la 6G se gagne dans la donnée en temps réel
- BlueSecure repense la sensibilisation à la cybersécurité avec des formats immersifs et engageants
Articles les + lus
Computex 2026 : 5 signaux forts à retenir
La chaîne d’approvisionnement, point de rupture récurent du SI
Microsoft Build 2026 : contre-offensive des modèles maison face à OpenAI et Anthropic
Rhea1 : SiPearl allume le CPU européen le plus ambitieux pour le HPC et l’IA souveraine
Analyse Patch Tuesday Mai 2026
À la une de la chaîne Tech
- Computex 2026 : 5 signaux forts à retenir
- La chaîne d’approvisionnement, point de rupture récurent du SI
- Microsoft Build 2026 : contre-offensive des modèles maison face à OpenAI et Anthropic
- Rhea1 : SiPearl allume le CPU européen le plus ambitieux pour le HPC et l’IA souveraine
- Analyse Patch Tuesday Mai 2026
