Ceci nous amène à la problématique d’intégration des données. Les données proviennent généralement de nombreuses sources de l’entreprise voire de l’extérieur de l’entreprise. Elles sont très souvent hétérogènes, possèdent leurs propres règles, leurs propres formats et chacune a ses défauts. Il arrive qu’une source de données
La problématique
ne soit pas fiable.
Un processus mal maîtrisé, comme un fichier manquant une fois sur deux ; un outil vieillissant qui travaille avec des formats non standard ; une fusion d’entreprises qui n’ont pas les mêmes références ; il y a de nombreux cas pour lesquels on ne peut pas faire confiance intégralement aux données qui vont être injectées dans notre DataWarehouse.
Il faut donc gérer des problèmes de qualité des données. Un des problèmes de qualité des données les plus courants est la gestion des données manquantes et ce sera ce point précis que nous allons détailler. Pour illustrer ce problème, nous allons prendre un exemple simple. Notre solution analyse des ventes ; nous prendrons la base de données d’exemple de Microsoft Adventure Works.
Nous allons étudier le cas où une vente n’est pas associée à un produit du catalogue. Dans notre scénario, notre processus d’intégration consolide les ventes des différents magasins et s’appuie sur un catalogue central de produits. Il peut arriver qu’une vente ne corresponde à aucun article de notre système central d’analyse des ventes. Voir figure 1.
Nous allons voir les différents moyens de gérer cela. Les solutions seront abordées d’un point de vue technique avec l’offre décisionnelle de Microsoft, basée sur SQL Server. Mais nous aurons aussi une approche plus méthodologique, pour traiter le problème de fond.
Téléchargez cette ressource
Plan de sécurité Microsoft 365
Les attaquants savent comment prendre le contrôle de votre tenant Microsoft 365, et vous, savez-vous comment le reprendre en main ?
Les articles les plus consultés
Les plus consultés sur iTPro.fr
- ADI, l’infrastructure de données de Scality pensée pour l’ère de l’IA et de la souveraineté
- Les coûts cachés des merge requests générées par l’IA
- WatchGuard lance Rai, une IA agentique taillée pour les MSP
- Mythos révèle les limites d’un Zero Trust centré sur le réseau
Articles les + lus
Analyse Patch Tuesday Mai 2026
Les coûts cachés des merge requests générées par l’IA
Femmes et métiers de la tech : une attractivité réelle freinée par des stéréotypes persistants
Moderniser le développement logiciel : de la fragmentation à l’intégration
Analyse Patch Tuesday Avril 2026
À la une de la chaîne Tech
- Analyse Patch Tuesday Mai 2026
- Les coûts cachés des merge requests générées par l’IA
- Femmes et métiers de la tech : une attractivité réelle freinée par des stéréotypes persistants
- Moderniser le développement logiciel : de la fragmentation à l’intégration
- Analyse Patch Tuesday Avril 2026
