Spark and AWS Glue Performance Tuning and Troubleshooting

Learn to diagnose Spark out-of-memory errors, optimize AWS Glue worker scaling, and configure efficient Parquet data layouts for faster, cost-effective data pipelines.

⏱ 1 h 27 min 📚 6 leçons 🎧 Version audio

À propos de ce cours

Slow data pipelines and unexpected out-of-memory errors can stall your data engineering workflows and inflate cloud costs. This text-based course guides you through the mechanics of the Spark execution engine and AWS Glue to help you build highly optimized data pipelines. You will transition from basic pipeline configurations to confidently diagnosing bottlenecks and fine-tuning engine performance. What you'll learn: - Understand core Spark memory management, executor behaviors, and driver roles. - Diagnose Spark out-of-memory (OOM) errors by analyzing failure signatures in CloudWatch logs. - Configure AWS Glue worker scaling strategies, comparing horizontal scaling with vertical worker upgrades. - Optimize data layout using Snappy-compressed Parquet files and ideal file-sizing practices. - Apply partition pruning and modern data storage layouts to minimize data scanning and accelerate queries. This comprehensive text-only course begins with foundational concepts of distributed computing before moving into hands-on diagnostic scenarios and scaling strategies. Designed for data engineers, developers, and cloud practitioners, this course requires only a basic familiarity with data pipelines. Start reading today to master the art of data engine optimization.

Ce que vous recevez

  • 📜 Certificat de fin
    Ajoutez-le à votre profil LinkedIn
  • 🎧 Version audio incluse
    Apprenez en déplacement, sans écran
  • ♾️ Accès à vie
    Revenez quand vous voulez, sans expiration
  • 📱 Téléphone ou ordinateur
    Fonctionne partout, sur tout appareil
  • 💸 Remboursement 30 jours
    Sans poser de questions
  • Court et ciblé
    1 h 27 min de contenu pratique

Avis

Pas encore d'avis — soyez le premier à partager votre expérience.

Écrire un avis

Nous vous demanderons de vous connecter après envoi — votre brouillon est sauvegardé.

Questions fréquentes

De quoi ai-je besoin pour suivre ce cours ? +

Un téléphone ou un ordinateur avec internet, c'est tout. Aucune installation, aucun matériel spécial.

Comment payer ? +

Carte via Stripe ou cryptomonnaie. Nous ne stockons pas les données de carte — Stripe les gère de manière sécurisée.

Puis-je obtenir un remboursement ? +

Oui — remboursement complet sous 30 jours, sans question.

Combien de temps aurai-je accès ? +

À vie. Une fois acheté, le cours est à vous, vous pouvez y revenir quand vous voulez.

Vais-je obtenir un certificat ? +

Oui. À la fin, vous recevez un certificat à ajouter à votre profil LinkedIn.

Conçu pour les apprenants en
Tech Design Finance Marketing Santé Éducation Hôtellerie Industrie