Serverless Data Processing with Dataflow: Develop Pipelines en Español
About this course
En esta segunda parte de la serie de cursos sobre Dataflow, analizaremos en profundidad el desarrollo de canalizaciones con el SDK de Beam. Comenzaremos con un repaso de los conceptos de Apache Beam. A continuación, analizaremos el procesamiento de datos de transmisión con ventanas, marcas de agua y activadores. Luego, revisaremos las opciones de fuentes y receptores en sus canalizaciones, los esquemas para expresar datos estructurados y cómo realizar transformaciones con estado mediante las API de State y de Timer. Después, revisaremos las prácticas recomendadas que ayudan a maximizar el rendimiento de las canalizaciones. Al final del curso, presentaremos SQL y Dataframes para representar su lógica empresarial en Beam y cómo desarrollar canalizaciones de forma iterativa con notebooks de Beam.
71/100
CourseAsk score
- What the provider tells you
- 39/45
- Who stands behind it
- 20/35
- How complete the listing is
- 12/20
Scores how much the provider publishes and who stands behind it — not how well it is taught.
What you'll learn
- understand Apache Beam concepts
- implement data streaming processing
- design data pipelines with sources and sinks
- apply stateful transformations
- optimize pipeline performance
- utilize SQL and DataFrames in Beam
Course objectives
- to deepen understanding of data pipelines development
- to enhance skills in real-time data processing
- to familiarize with optimal practices in Dataflow
Price shown by Coursera — confirm on their site.
Enroll on CourseraYou'll be redirected to Coursera to complete enrollment.
- Listed & compared by CourseAsk
- English · 0
Coursera