Shadow
Publiée il y a un mois · Paris
MLOps Engineer (H/F/X)
- Paris
Description du poste
Dans le cadre de la stratégie de l’entreprise, le/la Senior MLOps Engineer construit et opère l’infrastructure et les plateformes qui font tourner notre nouvelle ligne de produits AI managés (l’inférence en tête), en s’appuyant sur les dizaines de milliers de GPU dont dispose Shadow. Nos heures creuses sont les heures pleines des entreprises B2B : nos GPU, principalement sollicités la nuit par nos gamers, représentent une forte capacité de calcul que nous voulons valoriser pour devenir un leader du spot inference. Le/la Senior MLOps Engineer est garant(e) de la fiabilité, de la performance et de l’efficience (coût/GPU) des systèmes de mise en production des modèles : pipelines de déploiement, scaling, observabilité, et automatisation de bout en bout. Il/elle apporte une expertise senior sur l’exploitation à grande échelle de charges d’inférence sur GPU en environnement multi-tenant. Le poste est hands-on et à fort impact : concevoir et implémenter les fondations MLOps, mais aussi établir les standards, mentorer les contributeurs et influencer les choix d’architecture aux côtés du Head of PaaS. Dans un contexte de bootstrap, l’autonomie, le sens de l’ownership et la capacité à trancher techniquement sont déterminants. Rattaché(e) au Head of PaaS, il/elle veille à la bonne mise en œuvre des processus, des méthodes et des niveaux d’exigence fixés globalement pour toutes les équipes, et participe à la vie de l’Engineering avec les autres contributeurs et équipes. Dans ce rôle : Vous concevrez, implémenterez et opérerez les pipelines de déploiement et de serving des modèles d’inférence (CI/CD, model registry, rollout). Vous construirez et exploiterez le moteur de spot inference valorisant la capacité GPU non-utilisée en heures creuses. Vous mettrez en place l’observabilité, le monitoring et l’alerting (latence, débit, saturation GPU, SLO/SLA). Vous optimiserez l’efficience GPU : autoscaling, packing, scheduling et multi-tenancy. Vous automatiserez le
Annonce publiée sur Welcome to the Jungle et reprise par Intelligence Academy. Seule l'annonce d'origine fait foi ; nous ne sommes pas l'employeur.
Offres semblables
Développeur Java / Angular - IA - Freelance
Collective.work
- 8ème Arrondissement
- Freelance
Description du poste Taux journalier (TJM): 400 Contexte Le département Tech Expertise & Solutions a pour vocation d'accompagner la transformation digitale de nos métiers, en lien avec la stratégie d'un grand groupe bancaire. Ce centre d'expertise transverse est orienté développement, innovation, data, IA Prestation au
Tech Lead IA Junior (H/F)
Fed Group
- Paris
- 50 k€ – 60 k€ / an
Fed IT, cabinet entièrement dédié aux recrutements spécialisés sur les métiers de l'informatique (Infra, Data, Développement, MOA, MOE, Management), recherche pour un de ses clients dans le secteur de la santé basé à Paris, un ou une : Tech Lead IA Junior (H/F). Le poste est à pourvoir dans le cadre d'un CDI chez le cl
- Paris
- CDI
- 45 k€ / an
Salaire: 45ke Et si votre prochain projet faisait grandir vos compétences autant que votre carrière ? Chez K-LAGAN, nous faisons vivre chaque projet grâce aux talents qui le portent, en alliant expertise technique et accompagnement personnalisé. Aujourd'hui, nous recherchons un(e) Développeur(se) Full Stack à domin
Consultant SRE - IA - Freelance
Collective.work
- 8ème Arrondissement
- Freelance
Description du poste Taux journalier (TJM): ~600 Contexte Dans le cadre du développement et de l’industrialisation d’une plateforme dédiée à l’IA agentique, le consultant intégrera une équipe en charge du socle technique permettant de déployer, superviser et exploiter des agents IA en production. L’objectif de la missi
