Praktiken und Werkzeuge für die Bereitstellung, Überwachung und Steuerung von ML-Modellen in der Produktion, die die Zusammenarbeit zwischen Entwicklung und Betrieb für zuverlässige, reproduzierbare ML-Systeme verbinden.
Archived. This article has not been updated since the publish date above. The dynamic nature of information means that previously accurate content can become outdated or even obsolete over time. Readers are advised to exercise due diligence and cross-check any information found in this blog post before making decisions or adopting any practices based on said information.
MLOps (Machine Learning Operations) ist eine Kernfunktion des Machine Learning Engineering. Es legt den Schwerpunkt auf die Prozessoptimierung bei der Überführung von Machine-Learning-Modellen in die Produktion sowie auf deren anschließende Wartung und Überwachung. MLOps ist eine kollaborative Funktion, an der häufig Data Scientists, DevOps Engineers und die IT beteiligt sind.

MLOps ist ein sinnvoller Ansatz für die Erstellung und Qualitätsprüfung von ML- und KI-Lösungen. Durch das Implementieren eines MLOps-Ansatzes können Data Scientists und ML Engineers gemeinsam durch die Kombination von CI/CD-Praktiken (Continuous Integration/Continuous Deployment) mit angemessenen Funktionen für Überwachung, Bewertung und Governance von ML-Modellen Modellentwicklung und -produktion beschleunigen.
Es ist schwierig, maschinelles Lernen in die Produktion zu überführen. Ein ML-Lebenszyklus besteht aus vielen komplexen Komponenten wie Datenerfassung, Datenaufbereitung, Training, Modelloptimierung, Modellimplementierung, Überwachung, Erklärbarkeit und vielem mehr. Zudem erfordert er Zusammenarbeit und übergreifende Aufgabenverteilung mehrerer Teams – vom Data Engineering über Data Science bis hin zum ML Engineering. Ebenso ist eine betriebliche Konsequenz notwendig, um alle diese Prozesse zu synchronisieren und gemeinsam zu bearbeiten. MLOps umfasst das Experimentieren, Iterieren und fortlaufende Verbessern des ML-Lebenszyklus.
Die wesentlichen Vorteile von MLOps sind Effizienz, Skalierbarkeit und Risikominderung. Effizienz: MLOps ermöglicht Datenteams eine schnellere Modellentwicklung, die Bereitstellung hochwertigerer ML-Modelle sowie eine schnellere Implementierung und Produktion. Skalierbarkeit: MLOps bietet außerdem umfassende Skalierbarkeit und Verwaltung, sodass Tausende von CI/CD-Modellen beaufsichtigt, gesteuert, verwaltet und überwacht werden können. Insbesondere sorgt MLOps für die Reproduzierbarkeit von ML-Pipelines, wodurch eine engere Zusammenarbeit zwischen Datenteams ermöglicht, Konflikte mit Entwicklern und der IT reduziert und die Release-Geschwindigkeit beschleunigt werden. Risikominderung: ML-Modelle erfordern häufig eine behördliche Prüfung und Driftkontrolle. MLOps bietet mehr Transparenz, erlaubt eine schnellere Reaktion auf solche Anfragen und gewährleistet eine bessere Compliance im Hinblick auf Unternehmens- oder Branchenrichtlinien.

Das MLOps-Spektrum eines ML-Projekts kann so breit oder tief sein, wie es das Projekt erfordert. In bestimmten Fällen kann MLOps alles umfassen – von der Pipeline bis zur Modellproduktion –, während für andere Projekte vielleicht nur die MLOps-Implementierung des Modellbereitstellungsprozesses erforderlich ist. Die meisten Unternehmen wenden die MLOps-Prinzipien wie folgt an:
Die bewährten Verfahren für MLOps lassen sich anhand der Phase abgrenzen, in der sie jeweils angewendet werden.
MLOps ist eine Reihe von Entwicklungspraktiken, die speziell für ML-Projekte gelten und sich an den weiter verbreiteten DevOps-Prinzipien im Software-Engineering orientieren. Während DevOps einen schnellen, kontinuierlich iterativen Ansatz für die Auslieferung von Anwendungen vermittelt, nutzt MLOps dieselben Prinzipien, um ML-Modelle in die Produktion zu überführen. In beiden Fällen ist das Ergebnis eine höhere Softwarequalität, schnelleres Patching, beschleunigte Releases und eine höhere Kundenzufriedenheit.
Zwar gelten viele MLOps-Konzepte nach wie vor, doch sind beim Training von Large-Language-Modellen (LLMs) wie Dolly andere Überlegungen zu berücksichtigen. Wir wollen einige der zentralen Aspekte abhandeln, in denen sich das LLM-Training vom herkömmlichen MLOps-Ansatz unterscheiden kann:
Eine MLOps-Plattform stellt eine kollaborative Umgebung bereit, die Data Scientists und Software Engineers iterative Datenexploration, Echtzeit-Kooperationsfunktionen für das Tracking von Experimenten, Feature-Engineering und Modellverwaltung sowie kontrollierte Modelltransition, -bereitstellung und -überwachung bietet. MLOps automatisiert die Betriebs- und Synchronisierungsaspekte des ML-Lebenszyklus.

Probieren Sie Databricks aus. Databricks ist eine vollständig verwaltete Umgebung für MLflow, die weltweit führende quelloffene MLOps-Plattform. https://www.databricks.com/try/databricks-free-ml
Abonnieren Sie unseren Blog und erhalten Sie die neuesten Beiträge direkt in Ihren Posteingang.