Data Engineer Confirmé
Indexed description
Des voitures autonomes aux robots qui sauvent des vies, nos experts en technologies digitales et logicielles sortent des sentiers battus en fournissant des services uniques de R&D et d'ingénierie dans tous les secteurs d'activité.
Rejoignez-nous pour une carrière pleine d'opportunités, où vous pouvez faire la différence et où aucun jour ne se ressemble.
Formation :
Bac+5 / Diplôme d’ingénieur ou Master en Data Engineering, Informatique, Big Data, Systèmes d’Information ou tout autre domaine équivalent lié au traitement et à l’architecture des données.
Expérience :
- Concevoir et développer des pipelines de données efficaces, fiables et évolutifs pour alimenter les plateformes analytiques et opérationnelles.
- Implémenter des solutions de stockage et de traitement de données à grande échelle, adaptées aux environnements distribués.
- Optimiser les performances des systèmes de données existants afin de garantir un traitement rapide, robuste et sécurisé.
- Collaborer étroitement avec les data scientists pour industrialiser et déployer des modèles analytiques et de machine learning en production.
- Assurer la qualité, la sécurité, la traçabilité et la gouvernance des données tout au long de leur cycle de vie.
- Excellente maîtrise des langages et environnements techniques : Python, Scala, SQL, ainsi que des technologies Big Data telles que Spark, Hadoop et Kafka.
- Expérience solide dans le développement de pipelines de données (ETL/ELT), le traitement batch et streaming, ainsi que la mise en place de solutions Data Lakes.
- Bonne connaissance des environnements cloud (AWS, Azure, GCP) et des outils d’orchestration et de conteneurisation comme Airflow, Docker et Kubernetes.
- Maîtrise des pratiques essentielles :
- Data Engineering, ETL/ELT, Data Pipelines
- Big Data, Streaming, Batch Processing
- Cloud Data Architecture, Data Lakes
- DataOps, Data Governance, Data Quality
- Contribuer à la conception d’architectures data performantes intégrant des flux batch et temps réel.
- Travailler avec des environnements distribués et des technologies Big Data telles que Spark, Hadoop ou Kafka.
- Développer et maintenir des pipelines et orchestrations complexes à l’aide d’outils tels que Airflow.
- Participer au déploiement, à la surveillance et à l’évolution des solutions cloud sur AWS, Azure ou GCP.
- Collaborer avec les équipes métiers et techniques pour comprendre leurs besoins, structurer les données et proposer des solutions data adaptées.
- Documenter les architectures, les flux et les bonnes pratiques afin d’assurer la cohérence et la pérennité des solutions mises en place.
Capgemini est un leader mondial, responsable et multiculturel, regroupant près de 350 000 personnes dans plus de 50 pays. Fort de 55 ans d’expérience, nous sommes un partenaire stratégique des entreprises pour la transformation de leurs activités en tirant profit de toute la puissance de la technologie et des innovations dans les domaines en perpétuelle évolution tels que le cloud, la data, l’Intelligence Artificielle, la connectivité, les logiciels, l’ingénierie digitale ou les plateformes.
Create a free Caio profile to unlock more results and save your role and location preferences.
Unlock free search