Serverless Data Processing with Dataflow: Develop Pipelines en Español

Coursera MOOC / Non-credit USD 49
Enroll now →
Serverless Data Processing with Dataflow: Develop Pipelines en Español

About this course

En esta segunda parte de la serie de cursos sobre Dataflow, analizaremos en profundidad el desarrollo de canalizaciones con el SDK de Beam. Comenzaremos con un repaso de los conceptos de Apache Beam. A continuación, analizaremos el procesamiento de datos de transmisión con ventanas, marcas de agua y activadores. Luego, revisaremos las opciones de fuentes y receptores en sus canalizaciones, los esquemas para expresar datos estructurados y cómo realizar transformaciones con estado mediante las API de State y de Timer. Después, revisaremos las prácticas recomendadas que ayudan a maximizar el rendimiento de las canalizaciones. Al final del curso, presentaremos SQL y Dataframes para representar su lógica empresarial en Beam y cómo desarrollar canalizaciones de forma iterativa con notebooks de Beam.

What you'll learn

  • understand Apache Beam concepts
  • implement data streaming processing
  • design data pipelines with sources and sinks
  • apply stateful transformations
  • optimize pipeline performance
  • utilize SQL and DataFrames in Beam

Course objectives

  • to deepen understanding of data pipelines development
  • to enhance skills in real-time data processing
  • to familiarize with optimal practices in Dataflow

Skills you'll gain

Related courses

Course details are provided by the platform and may change — always confirm on the provider's site. Links may be affiliate links.