Programme IA sur mesureC'est gratuit →

Shadow

Publiée il y a un mois · Paris

MLOps Engineer (H/F/X)

  • Paris

Description du poste

Dans le cadre de la stratégie de l’entreprise, le/la Senior MLOps Engineer construit et opère l’infrastructure et les plateformes qui font tourner notre nouvelle ligne de produits AI managés (l’inférence en tête), en s’appuyant sur les dizaines de milliers de GPU dont dispose Shadow. Nos heures creuses sont les heures pleines des entreprises B2B : nos GPU, principalement sollicités la nuit par nos gamers, représentent une forte capacité de calcul que nous voulons valoriser pour devenir un leader du spot inference. Le/la Senior MLOps Engineer est garant(e) de la fiabilité, de la performance et de l’efficience (coût/GPU) des systèmes de mise en production des modèles : pipelines de déploiement, scaling, observabilité, et automatisation de bout en bout. Il/elle apporte une expertise senior sur l’exploitation à grande échelle de charges d’inférence sur GPU en environnement multi-tenant. Le poste est hands-on et à fort impact : concevoir et implémenter les fondations MLOps, mais aussi établir les standards, mentorer les contributeurs et influencer les choix d’architecture aux côtés du Head of PaaS. Dans un contexte de bootstrap, l’autonomie, le sens de l’ownership et la capacité à trancher techniquement sont déterminants. Rattaché(e) au Head of PaaS, il/elle veille à la bonne mise en œuvre des processus, des méthodes et des niveaux d’exigence fixés globalement pour toutes les équipes, et participe à la vie de l’Engineering avec les autres contributeurs et équipes. Dans ce rôle : Vous concevrez, implémenterez et opérerez les pipelines de déploiement et de serving des modèles d’inférence (CI/CD, model registry, rollout). Vous construirez et exploiterez le moteur de spot inference valorisant la capacité GPU non-utilisée en heures creuses. Vous mettrez en place l’observabilité, le monitoring et l’alerting (latence, débit, saturation GPU, SLO/SLA). Vous optimiserez l’efficience GPU : autoscaling, packing, scheduling et multi-tenancy. Vous automatiserez le

Annonce publiée sur Welcome to the Jungle et reprise par Intelligence Academy. Seule l'annonce d'origine fait foi ; nous ne sommes pas l'employeur.

Offres semblables

  • 8ème Arrondissement
  • Freelance

Description du poste Taux journalier (TJM): 400 Contexte Le département Tech Expertise & Solutions a pour vocation d'accompagner la transformation digitale de nos métiers, en lien avec la stratégie d'un grand groupe bancaire. Ce centre d'expertise transverse est orienté développement, innovation, data, IA Prestation au

via Adzuna
aujourd'hui
  • Paris
  • 50 k€ – 60 k€ / an

Fed IT, cabinet entièrement dédié aux recrutements spécialisés sur les métiers de l'informatique (Infra, Data, Développement, MOA, MOE, Management), recherche pour un de ses clients dans le secteur de la santé basé à Paris, un ou une : Tech Lead IA Junior (H/F). Le poste est à pourvoir dans le cadre d'un CDI chez le cl

via Adzuna
  • Paris
  • CDI
  • 45 k€ / an

Salaire: 45ke Et si votre prochain projet faisait grandir vos compétences autant que votre carrière ? Chez K-LAGAN, nous faisons vivre chaque projet grâce aux talents qui le portent, en alliant expertise technique et accompagnement personnalisé. Aujourd'hui, nous recherchons un(e) Développeur(se) Full Stack à domin

via France Travail
aujourd'hui
  • 8ème Arrondissement
  • Freelance

Description du poste Taux journalier (TJM): ~600 Contexte Dans le cadre du développement et de l’industrialisation d’une plateforme dédiée à l’IA agentique, le consultant intégrera une équipe en charge du socle technique permettant de déployer, superviser et exploiter des agents IA en production. L’objectif de la missi

via Adzuna

Toutes les offres Ingénieur / développeur IA →