Entrepôt de données : revue de ce qu’il ne faut pas faire
Michel Bruley
Sans entrer dans la problématique du choix des fournisseurs, les lignes ci-dessous recensent sous forme de recommandations, les principales idées qui sont largement répandues et qu’il ne faut surtout pas suivre.
Pour réaliser votre entrepôt de données, ne consultez aucune personne extérieure à votre organisme. Votre cas est unique et seules des personnes de chez vous peuvent trouver la solution qui convient. Ne cherchez pas à savoir ce que font vos concurrents, ne regardez pas les références de fournisseurs de solutions décisionnelles.
Fixez-vous comme premier objectif de spécifier de façon exhaustive tous les besoins décisionnels de votre organisme, en particulier soignez particulièrement bien la définition détaillée des restitutions attendues.
Cherchez à satisfaire les utilisateurs en leur réalisant des systèmes personnels sur mesure. Concrètement il s’agit de multiplier les data marts dans une logique de construire pour chaque division, département voire service, des moyens totalement adaptés au périmètre de leur problématique, en particulier à leur vocabulaire, à leur façon de voir les données sans se soucier d’autre chose que de leur vision spécifique des affaires. À chacun sa vérité.
Planifiez de multiples projets décisionnels en parallèle, sans vous soucier de fixer des priorités ni de produire rapidement des résultats.
Évitez le plus possible de stocker des données détaillées et fondez les systèmes sur des données agrégées, des compteurs du type RFM, et faites une large place aux données d’enquêtes, d’études ponctuelles et d’informations qualitatives que les utilisateurs maîtrisent bien, voire produisent eux-mêmes.
Au niveau de la modélisation, bannissez la 3ème forme normale, fondez le plus possible les datamarts sur des modèles en étoile ou en flocon, de façon à optimiser au maximum les performances des requêtes qui sont envisagées au moment de la conception du système.
Pour les restitutions, simplifiez le plus possible la vie des utilisateurs en fournissant des résultats facilement compréhensibles comme des moyennes, des médianes ou des métriques synthétiques, qui permettent de suivre simplement des sujets complexes.
Pour faciliter l’appréciation des performances fondez exclusivement les suivis sur des comparaisons entre données de prévision et de réalisation, en veillant à ne pas trop multiplier les chiffres et à rester très synthétique, en particulier il convient de limiter la profondeur de l’historique des données.
Au niveau des moyens technologiques, privilégiez des solutions prêtes à l’emploi spécifiques, quitte à multiplier les fournisseurs et les moyens.
Défendez bec et ongles l’idée que la vérité est dans les statistiques.
Investissez un minimum dans votre entrepôt de données, gardez le plus possible votre argent au fond d’un coffre, il y sera en sécurité.
> A LIRE EN CE MOMENT SUR DECIDEO
-
Avant même d’arriver en France, Muse, le nouvel agent IA de Meta devance tous ses concurrents en matière de collecte de données
-
Aplim lance "Pilotage 360" : Mieux comprendre son établissement pour mieux le piloter
-
Lobster accélère son développement en France et entend simplifier les échanges de données entre les entreprises
-
Progress Software unifie la connaissance d'entreprise au sein de ses systèmes d'information avec de nouvelles fonctionnalités de RAG agentique
-
AVEVA Day France 2026 : quand la donnée industrielle devient un levier concret de performance et de transformation
-
Semarchy publie ses Intelligent Data Products et leur contexte sémantique dans Microsoft Fabric
-
Semarchy enrichit les Intelligent Data Products et apporte à l’IA un contexte métier fiable
-
Agents IA en entreprise : pourquoi le modèle de langage ne devrait jamais produire un chiffre
-
Servier adopte Veeva OpenData au niveau mondial pour déployer l'IA à grande échelle
-
40 ans à façonner la gestion de l’information dans un monde en constante évolution