Data Engineering: Pipelines, ETL, Hadoop
Completed by Anna Polyvana
April 28, 2025
3 hours (approximately)
Anna Polyvana's account is verified. Coursera certifies their successful completion of Data Engineering: Pipelines, ETL, Hadoop
What you will learn
Analyse the architecture and components of data pipelines to understand their impact on data flow and processing efficiency.
Implement robust ETL processes, for scalability and maintainability.
Analyze big data challenges and introduce Hadoop ecosystem tools (HDFS, MapReduce, Hive, Pig, and Spark) for data processing tasks.
Skills you will gain
- Category: Apache Hive
- Category: Apache Hadoop
- Category: Data-Driven Decision-Making
- Category: Extract, Transform, Load
- Category: Data Management
- Category: Scalability
- Category: Data Architecture
- Category: Data Strategy
- Category: Apache Spark
- Category: Data Analysis
- Category: Data Transformation
- Category: Big Data

