Kursbeschreibung

Dieser Kurs gibt dir einen umfassenden Überblick über Data Version Control (DVC), ein Tool, das für die effiziente Verwaltung und Versionierung von Daten für maschinelles Lernen entwickelt wurde. Du lernst den Produktlebenszyklus des maschinellen Lernens kennen, verstehst den Unterschied zwischen Datenversionierung und Codeversionierung und schaust dir die Funktionen und Anwendungsfälle von DVC an.

Entdecke die Funktionen von DVC

Du wirst die Gründe für die Datenversionierung, den Lebenszyklus des maschinellen Lernens und die besonderen Funktionen und Anwendungsfälle von DVC verstehen. Du lernst auch was über die DVC-Einrichtung, einschließlich Installation, Repository-Initialisierung und die Datei .dvcignore. Du wirst DVC-Cache- und Staging-Dateien erkunden, lernen, wie man Dateien hinzufügt und entfernt, Caches verwaltet und die zugrunde liegenden Mechanismen versteht. Du lernst was über DVC-Remotes, bekommst erklärt, wie sich DVC- und Git-Remotes unterscheiden, und kannst Remotes hinzufügen, auflisten und ändern. Du lernst, wie du mit Remote-Servern interagierst, Daten pushst und pullst, bestimmte Versionen auscheckst und Daten in den Cache holst.

Automatisieren und bewerten

Du wirst motiviert sein, ML-Pipelines zu automatisieren, wobei der Schwerpunkt auf der Modularisierung von Code und der Erstellung einer Konfigurationsdatei liegt. Du lernst DVC-Pipelines als gerichtete azyklische Graphen kennen und kannst selbst Stufen und deren Ein- und Ausgänge hinzufügen. Du wirst üben, diese Pipelines effizient auszuführen, um verschiedene Anwendungsfälle beim Training von Machine-Learning-Modellen zu ermöglichen. Der Kurs endet mit einem Fokus auf die Auswertung und zeigt, wie Metriken und Plots in DVC verfolgt werden.

Voraussetzungen

Supervised Learning with scikit-learn Introduction to Git

Introduction to DVC

This chapter provides a comprehensive introduction to Data Version Control (DVC), a tool essential for data versioning in machine learning. Learners will explore the motivation behind data versioning, understand its differences from code versioning, and experiment with a simple classification problem. They will review basic Git commands, learn about DVC, and practice setting up a repository. The chapter concludes with an overview of DVC’s features and use cases, including versioning data and models, CI/CD for machine learning, experiment tracking, pipelines, and more.

Kursbeschreibung

Entdecke die Funktionen von DVC

Automatisieren und bewerten

Leistungsnachweis verdienen

Schließe dich .css-nklxlk{color:var(--wf-brand--main, #03EF62);}19 Millionen Lernenden an und starte Einführung in Data Versioning mit DVC heute!

Kostenloses Konto erstellen

DataCamp gibt es auch für Mobilgeräte

Schließe dich 19 Millionen Lernenden an und starte Einführung in Data Versioning mit DVC heute!