Elca informatique SA
Pully
Stage : Exploration du traitement des données en temps réel à grande échelle
- 02 octobre 2026
- 100%
- Pully
À propos de cette offre
Date de début : février 2027 · Durée : 6 mois
Veuillez inclure vos relevés de notes académiques les plus récents avec votre candidature. Les candidatures soumises sans relevés ne seront pas prises en compte.
Lors de ce stage de 6 mois débutant en février 2027, vous explorerez le traitement des données en temps réel à grande échelle avec Apache Kafka, Apache Flink et Apache Spark, et nous aiderez à définir des lignes directrices pour choisir le bon framework.
Vos missions
- Comprendre les concepts fondamentaux de Kafka, Flink et Spark, y compris leur architecture et leurs cas d'utilisation
- Mettre en œuvre un pipeline traitant des données en streaming provenant d'une source unique en utilisant Kafka et Flink/Spark, en allant aussi loin que possible avec des analyses et des optimisations
- Construire un second pipeline plus complexe : Base de données → Debezium → Kafka → Flink/Spark → requêtes transactionnelles et analytiques
- Gérer plusieurs tables et mettre en œuvre le watermarking pour assurer un traitement synchronisé des données
- Comparer Flink et Spark en termes de performance, facilité d'utilisation et adéquation à des cas d'utilisation spécifiques
- Documenter vos conclusions et proposer des lignes directrices pour choisir entre les deux frameworks
Ce que nous offrons
- Un lieu de travail dynamique et collaboratif avec une équipe hautement motivée et multiculturelle travaillant sur plusieurs sites internationaux
- La chance de faire une différence dans la vie des gens en construisant des solutions innovantes
- Des événements internes de codage tels que des hackathons et des sessions Brownbag, ainsi que notre blog technique
- Des afterworks mensuels organisés à chaque site
À propos de votre profil
- Étudiant en licence ou master en informatique, ingénierie des données ou domaine connexe
- Intérêt pour les systèmes distribués et le traitement des données en temps réel
- Compétences en programmation (par ex. Java, Scala ou Python) et connaissance du SQL
- Curiosité, autonomie et bonnes capacités d’analyse