Dieser fünfwöchige Onlinevertiefungskurs bietet eine praktische Einführung zum Entwerfen und Erstellen von Datenverarbeitungssystemen auf der Google Cloud Platform. In Präsentationen, Demos und praxisorientierten Labs entwickeln die Teilnehmer Datenverarbeitungssysteme, erstellen End-to-End-Datenpipelines, analysieren Daten und üben maschinelles Lernen. Dieser Kurs vermittelt den Teilnehmern die folgenden Kompetenzen: • Datenverarbeitungssysteme auf der Google Cloud Platform entwickeln • Unstrukturierte Daten mit Spark und ML-APIs auf Cloud Dataproc verwenden • Batch- und Streaming-Daten durch die Implementierung von Autoscaling-Datenpipelines auf Cloud Dataflow verarbeiten • Mit Google BigQuery Geschäftsinformationen aus extrem großen Datasets ableiten • Modelle des maschinellen Lernens mit TensorFlow und Cloud ML trainieren, auswerten und damit Vorhersagen treffen • Sofortige Statistiken aus Streaming-Daten ermöglichen • Dieser Kurs richtet sich an erfahrene Entwickler, die für die Verwaltung von Big Data-Transformationen verantwortlich sind, zum Beispiel: • Daten extrahieren, laden, transformieren, bereinigen und validieren • Pipelines und Architekturen für die Datenverarbeitung entwerfen • Modelle des maschinellen Lernens und der Statistik erstellen und warten • Datasets abfragen, Abfrageergebnisse visualisieren und Berichte erstellen >>> Mit Ihrer Teilnahme an dieser Spezialisierung stimmen Sie den Nutzungsbedingungen von Qwiklabs zu, die Sie in den FAQs und unter folgendem Link finden: https://qwiklabs.com/terms_of_service <<<
What you'll learn
Develop data processing systems on the Google Cloud Platform
Utilize unstructured data with Spark and ML-APIs on Cloud Dataproc
Process batch and streaming data by implementing autoscaling data pipelines on Cloud Dataflow
Derive business insights from extremely large datasets with Google BigQuery
Train, evaluate, and make predictions with machine learning models using TensorFlow and Cloud ML
Enable real-time statistics from streaming data
Course objectives
Extract, load, transform, clean, and validate data
Design pipelines and architectures for data processing
Create and maintain machine learning and statistical models
Query datasets, visualize query results, and create reports