Ingénieur·e DevOps GPU (F/H/X)
Indexed description
Vous intégrerez une équipe dédiée aux produits et services d’intelligence artificielle, au sein du domaine Data & IA, et contribuerez au déploiement, à l’industrialisation et à l’exploitation de plateformes GPUaaS et LLMaaS On-Premise.
Si vous souhaitez évoluer dans un environnement technologique exigeant et contribuer à des projets innovants autour de l’IA, cette mission est faite pour vous !
Missions principales
- Industrialiser et automatiser le déploiement de plateformes IA dans des environnements On-Premise sécurisés.
- Contribuer à l'évolution de l'architecture des plateformes GPUaaS et LLMaaS.
- Participer à la mise en place de services managés en intégrant les contraintes de sécurité, de conformité et de gouvernance.
- Assurer la mise en production, la documentation et le maintien en conditions opérationnelles et de sécurité des plateformes IA.
- Participer à l'amélioration et à l'automatisation des processus de déploiement et d'exploitation.
- Réaliser des présentations et démonstrations des offres et services développés.
- Collaborer au sein d'une équipe DevOps en environnement Agile.
- Participer aux rituels Agile, aux travaux de roadmap et à la gestion du backlog.
- Participer aux astreintes techniques du pôle.
- Expérience significative en DevOps et gestion de plateformes IA/ML.
- Expérience concrète dans la gestion et l'orchestration de ressources GPU, idéalement avec Kubernetes / OpenShift.
- Maîtrise de Kubernetes, OpenShift et Docker.
- Bonne connaissance des infrastructures On-Premise et notions d'environnements Cloud.
- Expérience avec des solutions d'orchestration GPU telles que Run.ai, Slurm, ClearML ou Volcano.
- Connaissance de NVIDIA GPU Operator et des environnements MLOps.
- Maîtrise des outils d'automatisation et CI/CD : GitLab CI/CD, Jenkins.
- Bonne connaissance des outils de supervision : Prometheus, Grafana, ELK Stack ou Dynatrace.
- Maîtrise du scripting Python et Bash ; Go serait un plus.
- Connaissance des architectures IA/ML et des frameworks Transformers, TensorFlow, PyTorch.
- Une certification CKA/CKAD ou OpenShift serait un plus.
- Une expérience avec Kestra serait appréciée.
- Maîtrise des outils Atlassian (Jira, Wiki).
- Excellent relationnel et capacité à collaborer avec différentes équipes techniques.
- Esprit d'équipe et goût pour le travail en environnement Agile.
- Force de proposition et capacité à contribuer aux évolutions de la plateforme.
- Rigueur et sens de l'organisation.
- Capacité à communiquer et à présenter des solutions techniques.
- Anglais opérationnel, avec un usage régulier dans un contexte professionnel.
- Formation supérieure en informatique, Bac+5 / M2 ou équivalent.
- Expérience de 6 à 10 ans, dont au minimum 5 ans dans les domaines de la Data et de l'automatisation des processus informatiques.
- Une expérience en environnement bancaire ou secteur régulé serait appréciée.
- Une expérience significative en exploitation et maintien en conditions opérationnelles de plateformes de production est attendue.
- Premier échange téléphonique avec un·e Responsable recrutement METALINE
- Un Entretien avec un·e Responsable commercial METALINE
- Rencontre avec le/la client·e
Create a free Caio profile to unlock more results and save your role and location preferences.
Unlock free search