Acquérez des compétences pratiques en ingénierie des données en apprenant à concevoir, développer et exécuter des pipelines ETL (Extract, Transform, Load) de bout en bout à l'aide d'Apache Spark. Dans cette formation pratique, vous commencerez par mettre en place un environnement de développement Spark, installer et configurer PySpark, Hadoop et MySQL, organiser les structures de projets ETL et explorer des ensembles de données réels.

Apache Spark : Conception et exécution de pipelines ETL (Hands-On)
La Fête du Travail commence avec plus de 70 $ d'économies sur Coursera Plus. Bénéficiez de 40 % de réduction pendant 3 mois.

Apache Spark : Conception et exécution de pipelines ETL (Hands-On)
Ce cours fait partie de Spécialisation "Spark et Python pour le Big data avec PySpark"

Instructeur : EDUCBA
Inclus avec En savoir plus
Demander à Coursera
23 avis
Expérience recommandée
Ce que vous apprendrez
Installer et configurer PySpark, Hadoop et MySQL pour les flux de travail ETL.
Construisez des applications Spark pour des chargements de données complets et incrémentaux via JDBC.
Appliquer des transformations, gérer les problèmes de déploiement et optimiser les pipelines ETL.
Compétences que vous acquerrez
- Catégorie : Pipelines de données
- Catégorie : Importation/exportation de données
- Catégorie : Traitement des données
- Catégorie : Transformation des données
- Catégorie : Analyse des données
- Catégorie : Ingénierie des données
- Catégorie : Magasin de données
- Catégorie : Environnement de développement
- Catégorie : Installation du logiciel
- Catégorie : SQL
- Catégorie : Analyse exploratoire des données
- Catégorie : Extraire, transformer, charger
Outils que vous découvrirez
- Catégorie : Apache Spark
- Catégorie : MySQL
- Catégorie : MySQL Workbench
- Catégorie : PySpark
- Catégorie : Apache Hadoop
Détails à connaître

Ajouter à votre profil LinkedIn
6 devoirs
Découvrez comment les employés des entreprises prestigieuses maîtrisent des compétences recherchées

Élaborez votre expertise du sujet
- Apprenez de nouveaux concepts auprès d'experts du secteur
- Acquérez une compréhension de base d'un sujet ou d'un outil
- Développez des compétences professionnelles avec des projets pratiques
- Obtenez un certificat professionnel partageable

Il y a 2 modules dans ce cours
Obtenez un certificat professionnel
Ajoutez ce titre à votre profil LinkedIn, à votre curriculum vitae ou à votre CV. Partagez-le sur les médias sociaux et dans votre évaluation des performances.
En savoir plus sur Analyse des données
Statut : Essai gratuit
Statut : Essai gratuit
Statut : Essai gratuit
Pour quelles raisons les étudiants sur Coursera nous choisissent-ils pour leur carrière ?

Felipe M.

Jennifer J.

Larry W.

Chaitanya A.
Avis des étudiants
- 5 stars
54,16 %
- 4 stars
33,33 %
- 3 stars
8,33 %
- 2 stars
0 %
- 1 star
4,16 %
Affichage de 3 sur 23
Révisé le 17 janv. 2026
Error handling and data quality considerations are touched upon, adding practical value.
Révisé le 16 avr. 2026
This hands-on course delivers practical exposure to building real-world Spark ETL pipelines, with useful exercises, though advanced optimization topics remain somewhat limited.
Révisé le 19 janv. 2026
Learners feel they actually build powerful pipelines — from raw ingestion to analytics-ready outputs, not just toy examples.
Foire Aux Questions
Plus de questions
Aide financière disponible,





