Back to search
Renault Group Linkedin · Posted 5d ago

CS27 - Bac+5 Stage Deep Reinforcement Learning pour la Prise de Décision en Conduite Autonome (H/F)

France

Linkedin
Continue to application Add your email once, then Caio opens the original posting.

Indexed description

Contexte et environnement de travail

Renault poursuit son engagement envers les jeunes au travers de la formation par l’alternance et les stages. Cette politique volontariste positionne Renault comme un des contributeurs majeurs au développement de l’apprentissage en France. Dans le cadre de votre stage, vous serez suivi par le service Emploi, compétences et Politiques Jeunes et plus particulièrement au sein des relations écoles et de la marque employeur de Renault.

La prise de décision en conduite autonome sur autoroute (comme le changement de voie) est un défi complexe qui nécessite de concilier sécurité, fluidité du trafic et confort des passagers. Les approches traditionnelles basées sur des règles empiriques montrent parfois leurs limites face à la diversité des scénarios réels.

Ce stage a pour objectif d'explorer le potentiel du Deep Reinforcement Learning (DRL) pour concevoir un système de prise de décision intelligent, capable d'apprendre à effectuer des changements de voie optimaux et sécurisés en environnement simulé.

Vos missions

Sous la responsabilité de votre tuteur, ingénieur développement logiciel ADAS/AD, vos missions s'articuleront autour des axes suivants :

Recherche Bibliographique & État De L'art

  • Analyser l'état de l'art scientifique sur l'apprentissage par renforcement (RL) appliqué à la conduite autonome et à la planification de trajectoire.

Modélisation En Simulation

  • Prendre en main et configurer l'environnement de simulation open-source highway-env (Python).

Modéliser Différents Scénarios De Trafic Autoroutier (densité De Trafic, Comportements Des Autres Véhicules). Développement De L'IA (Deep Reinforcement Learning)

  • Concevoir, implémenter et entraîner des algorithmes de DRL (ex: DQN, PPO, SAC) pour gérer les décisions de changement de voie.

Optimisation de la fonction de récompense (Reward Engineering) :

  • Définir et ajuster les critères de succès pour garantir un comportement optimal : sécurité (distances de sécurité, évitement de collisions), confort des passagers (accélérations fluides) et efficacité (vitesse cible, temps de trajet).

Évaluation Et Benchmark

  • Évaluer les performances du modèle entraîné face à des scénarios complexes et imprévus.
  • Comparer les résultats obtenus par l'IA avec les performances des systèmes d'aide à la conduite (ADAS) actuels basés sur des approches de contrôle classiques.

Qui êtes-vous ?

  • Formation : Étudiant(e) en dernière année d'École d'Ingénieur ou Master 2 en Informatique, Intelligence Artificielle, Robotique ou Automatique.
  • Compétences techniques requises :
    • Excellente maîtrise de Python.
    • Solides connaissances en Machine Learning / Deep Learning et idéalement en Reinforcement Learning (frameworks type PyTorch, TensorFlow, Stable-Baselines3).
    • Sensibilité aux problématiques de la conduite autonome, de la robotique ou de la théorie du contrôle.
  • Soft skills :
    • Curiosité scientifique, autonomie et force de proposition.
    • Rigueur méthodologique pour mener des expérimentations et analyser des résultats.
    • Bon niveau d'anglais (communication orale, lecture d'articles scientifiques et documentation technique).
Vous souhaitez participer à l’aventure de l’automobile de demain ? Rejoignez-nous ! 🚗💡
Free. 20 seconds. No password. See every match in this search.

Create a free Caio profile to unlock more results and save your role and location preferences.

Unlock free search
Want help applying to roles like this? Search Caio for free. If repetitive applications get heavy, Managed Job Search adds supervised execution for $99/month.
View Managed Job Search