Architecture décentralisée traitant les données comme un produit appartenant aux équipes de domaine, mettant l'accent sur l'infrastructure en libre-service, la gouvernance fédérée et l'interopérabilité.
Archived. This article has not been updated since the publish date above. The dynamic nature of information means that previously accurate content can become outdated or even obsolete over time. Readers are advised to exercise due diligence and cross-check any information found in this blog post before making decisions or adopting any practices based on said information.
Les données sont essentielles pour les entreprises : elles sont la matière première de l'innovation et du progrès. En raison de leur rôle croissant dans les activités et dans la prise de décision, elles sont à l'origine de défis majeurs pour les organisations qui veulent rester compétitives. Parce qu'ils créent des silos, réduisent la visibilité des données et compliquent leur traitement, les data lakes et les data warehouses traditionnels tendent à aggraver le problème. Ces obstacles et ces goulets d'étranglement entravent la collaboration et nuisent à l'exploitation de ressources pourtant précieuses. Les entreprises ont besoin d'une nouvelle architecture pour exploiter tout le potentiel de leurs données. Le data mesh est une architecture de données moderne à la hauteur des enjeux actuels.
Le data mesh est une architecture conçue pour gérer les données organisationnelles à grande échelle et en extraire davantage de valeur.
La décentralisation est la clé du data mesh. Les données sont encadrées et gérées de façon indépendante par les différents domaines de l'entreprise et non par une même équipe en charge de tous les datasets de l'organisation. Mais cette décentralisation est régie par des règles communes de gouvernance qui assurent l'interopérabilité, la sécurité et la cohérence sémantique des données.
Les gestionnaires de données de chaque domaine ont pour mission de fournir des produits de données de haute qualité et d'en garantir la sécurité. Comme ils ne sont responsables que des données métier de leur domaine, et non de toutes les données de l'organisation, ils sont en mesure de fournir des données plus pertinentes, avec davantage de rapidité et d'efficacité, tout en leur appliquant des règles strictes de gouvernance.
Les principes du data mesh offrent un équilibre idéal entre l'autonomie des fonctions et l'interopérabilité globale. Cette architecture limite le recours à des équipes centralisées et évite la formation de silos tout en créant un environnement propice à la collaboration. Les équipes ont ainsi la possibilité de développer en commun et de partager des produits de données qui génèrent une valeur commerciale pour l'organisation.
Une architecture logique data mesh repose sur quatre principes :