En tant que l'un des principaux cabinets comptables au monde, l'organisation mondiale KPMG opère dans 143 pays et territoires à travers le monde, offrant des services d'audit, de fiscalité et de conseil. Au service de plus de 82 % des entreprises du Fortune Global 500 et de plus de 80 % des entreprises du Forbes Global 1000, KPMG LLP s'est donné pour mission de fournir des informations pertinentes et opportunes de haute qualité à ses clients. En tant qu'entreprise axée sur les données et entrant dans l'ère de l'IA, KPMG a rapidement compris que son infrastructure Hadoop héritée souffrait de contraintes croissantes en termes de rapidité de mise sur le marché et de coûts prohibitifs en raison de l'augmentation rapide des volumes de données. KPMG s'est tourné vers la plate-forme de données intelligence de Databricks comme moteur principal pour piloter ses processus de transformation des données, d'analyse et de développement de modèles. Depuis le passage à Databricks, KPMG a constaté une productivité accrue, une commercialisation plus rapide et une évolutivité et des performances accrues.
L'architecture Hadoop héritée ralentit l'innovation
En tant que cabinet de services professionnels présent dans plus de 143 pays, KPMG International est un partenaire de confiance pour les entreprises de tous les secteurs, offrant des services d'audit, de fiscalité et de conseil. KPMG LLP, le cabinet membre américain de KPMG International, emploie plus de 40 000 personnes et dessert les 50 États américains. KPMG est fière de son engagement envers la qualité et l'excellence du service dans tout ce qu'elle fait. Pourtant, une infrastructure Hadoop vieillissante entravait sa capacité à répondre aux exigences de rapidité de mise sur le marché et à maintenir les coûts bas avec des volumes et une variété de données croissants rapidement. De plus, KPMG a compris les exigences croissantes de l'IA et avait besoin d'une solution suffisamment flexible, ouverte et agile pour répondre aux besoins d'un marché en évolution rapide.
Consciente de la nécessité de pérenniser sa plateforme de données, KPMG a entrepris une transition cruciale en 2021 pour transférer ses opérations de données des bases de données relationnelles locales vers Microsoft Azure, Azure Databricks étant un pilier essentiel de la stratégie de données cloud de KPMG LLP. Dennis Tally, qui dirige la mise en place d'une plate-forme de données moderne au sein de son bureau principal numérique, a expliqué : « Databricks a permis à KPMG de créer une architecture lakehouse évolutive et résiliente, alimentant la transformation des données, l'analyse et les charges de travail d'IA pour répondre aux besoins émergents de l'entreprise en matière d'IA, tout en réduisant la complexité et les coûts d'intégration des données. »
À l'heure actuelle, KPMG dispose d'une base solide de plus de 850 utilisateurs expérimentés actifs qui utilisent Databricks avec succès, soutenant des cas d'utilisation au sein du bureau principal du numérique et dans toute l'organisation dans des domaines tels que la finance, la prévision des risques et les ressources humaines. « Nous utilisons vraiment Databricks comme fondement de tout ce que nous faisons », a déclaré Tally.
Fédération transparente et gouvernance des données à l'ère moderne
Depuis qu'elle a choisi de moderniser sa plateforme avec Databricks, KPMG a pu fédérer ses données pour répondre facilement aux besoins d'analyse en aval et d'apprentissage automatique. Unity Catalog et Delta Sharing ont permis à KPMG de supprimer les silos de données existant dans l'entreprise, permettant ainsi la fédération des données provenant de diverses sources, notamment des serveurs SQL locaux, des entrepôts de données cloud et Azure Data Lake Storage. Cette polyvalence permet d'accélérer la rentabilisation des projets métier, car elle élimine le besoin d'intégrer manuellement les données. L'ajout de lignées automatiquement capturées et mises à jour simplifie davantage le processus, en facilitant l'identification des sources des ressources de données et de leur utilisation en aval. « La fédération est un élément clé de notre stratégie et nous utilisons actuellement Unity Catalog pour fédérer différentes sources de données en un seul endroit en production dans tous nos environnements. Le partage régi des données n'a jamais été aussi facile », a déclaré Tally. La gouvernance de Unity Catalog offre à KPMG un emplacement unique pour administrer les stratégies d'accès aux données qui s'appliquent à tous les espaces de travail. KPMG peut désormais définir ses politiques une seule fois, et celles-ci seront appliquées dans tout le lac, ce qui simplifie la gestion des contrôles d'accès, ce qui l'aide à respecter la réglementation et à mieux servir ses clients. La quantité de données gérées dans Databricks Unity Catalog dépasse actuellement 500 To et ne cesse d'augmenter. Avec plus de 850 utilisateurs actifs sur la plateforme, la valeur créée ne cesse de croître, des milliers de clients supplémentaires utilisant des tableaux de bord Power BI basés sur les données ingérées dans la lakehouse.
Databricks a non seulement fourni une solution de gouvernance idéale pour KPMG, mais Databricks SQL permet aux utilisateurs de toute l'entreprise d'exécuter des charges de travail BI et ETL à grande échelle tout en s'intégrant facilement à Power BI pour les tableaux de bord. Le calcul sans serveur évite à KPMG de gérer, configurer ou mettre à l'échelle son infrastructure cloud Azure sur le lakehouse, car son calcul SQL élastique Databricks SQL Serverless – découplé du stockage – s'adapte automatiquement aux cas d'utilisation à forte concurrence. Sur le plan de l'apprentissage automatique, MLflow fournit une plate-forme MLOps de bout en bout, rationalisant le processus de mise en production des modèles ML, puis de maintenance et de surveillance de ces modèles. Avec Unity Catalog et MLflow, KPMG peut tirer parti de la puissance de l'IA pour automatiser la surveillance, diagnostiquer les erreurs et maintenir la qualité des données et des modèles ML, libérant ainsi les scientifiques des données pour se concentrer sur l'innovation dans des domaines tels que l'évaluation des risques d'engagement, le service de prochaine qualité et les prévisions.
Au-delà des charges de travail principales d'ingénierie des données et d'IA, Databricks sert également les scientifiques des données et les analystes d'autres départements de KPMG avec des cas d'utilisation dans les domaines de la finance, de la croissance et de la stratégie, et du risque. KPMG utilise Databricks SQL pour soutenir le développement de tableaux de bord financiers et comptables à l'aide de Power BI, dépassant ainsi les limites des systèmes d'entreposage de données hérités et élargissant la valeur accessible pour l'entreprise. Du côté de la croissance et de la stratégie, Databricks Clean Rooms permet à KPMG de fournir un accès à des données de production en volume complet et à un ensemble d'outils de privilèges et d'ingénierie pour le développement distribué de l'analyse et de l'IA. Par exemple, l'équipe CDO déploie Databricks avec l'organisation de gestion des risques de KPMG pour développer des modèles qui évaluent et prédisent le risque associé aux engagements de KPMG LLP et déterminent quand les engagements ne sont pas correctement alignés pour la réussite des clients. Databricks a fourni un terrain de jeu commun aux équipes de science des données et d'ingénierie de KPMG LLP qui cherchent à développer la prochaine génération d'IA.
En accélérant vers l'avenir grâce aux données et à AI
Today, KPMG a créé une plate-forme de données moderne de premier ordre qui repose fortement sur Azure Databricks comme moteur sous-jacent pour exécuter la logique métier dans l'ensemble de l'entreprise. Avec Databricks, KPMG a unifié toutes ses données et son intelligence artificielle à l'échelle de l'entreprise. Tally a déclaré : « Pour la première fois, nous avons créé une véritable plateforme d'entreprise capable de répondre aux besoins dynamiques des professionnels du front-office et du back-office de KPMG. » Grâce à Databricks, KPMG a pu accroître sa productivité, accélérer ses délais de commercialisation et accroître son échelle et ses performances.
Databricks a également permis à KPMG de devenir un leader de l'industrie des données et de l'intelligence artificielle, en lui permettant d'expérimenter des technologies d'IA générative de pointe comme Databricks Assistant, un assistant d'IA sensible au contexte entièrement intégré à la plateforme Databricks. Databricks Assistant permet aux développeurs KPMG d'interroger des données en langage naturel via son interface conversationnelle. Il génère ensuite les requêtes SQL ou Python correspondantes en utilisant le contexte des cellules de code, des bibliothèques, des étiquettes, des tables courantes et des schémas du catalogue Unity.
À l'ère des nouvelles technologies telles que GenAI, KPMG continuera d'être à l'avant-garde de l'exploitation des technologies émergentes afin d'assurer les meilleurs résultats à ses clients. Tally a déclaré : « L'IA continuera de dominer notre activité, de la façon dont nous nous dirigeons en interne à l'utilisation des outils appropriés pour avoir un impact sur nos équipes d'engagement et, en fin de compte, sur nos clients. » Pour l'avenir, KPMG prévoit de poursuivre les innovations dans toute son organisation grâce à la plateforme de renseignements sur les données Databricks. « Nous sommes une organisation de services professionnels qui guide d'autres entreprises dans leur parcours d'IA, et il est impératif que nous excellions dans ce domaine », a conclu Tally.



