Traitement des données sans serveur avec Dataflow : cours 2

Coursera MOOC / Non-credit USD 49
Enroll now →
Traitement des données sans serveur avec Dataflow : cours 2

About this course

Dans ce deuxième volet de la série de cours sur Dataflow, nous allons nous intéresser de plus près au développement de pipelines à l'aide du SDK Beam. Nous allons commencer par passer en revue les concepts d'Apache Beam. Nous allons ensuite parler du traitement des données par flux à l'aide de fenêtres, de filigranes et de déclencheurs. Nous passerons ensuite aux options de sources et de récepteurs dans vos pipelines, aux schémas pour présenter vos données structurées, et nous verrons comment effectuer des transformations avec état à l'aide des API State et Timer. Nous aborderons ensuite les bonnes pratiques qui vous aideront à maximiser les performances de vos pipelines. Vers la fin du cours, nous présentons le langage SQL et les DataFrames pour représenter votre logique métier dans Beam, et nous expliquons comment développer des pipelines de manière itérative à l'aide des notebooks Beam.

What you'll learn

  • understand the concepts of Apache Beam
  • develop data processing pipelines with Beam SDK
  • implement stream processing techniques
  • apply stateful transformations using State and Timer APIs
  • use SQL and DataFrames for business logic representation

Course objectives

  • learn to optimize pipeline performance
  • familiarize with best practices in data handling
  • understand windowing, watermarks, and triggers for stream processing

Skills you'll gain

Related courses

Course details are provided by the platform and may change — always confirm on the provider's site. Links may be affiliate links.