Assistance Publique - Hôpitaux de Paris (AP-HP) (Paris)
Publiée il y a 12 jours · Paris
Ingénieur MLOps F/H
- Paris
- Intérim
- Télétravail possible
Outils et compétences cités dans l'annonce
Description du poste
Descriptif
- Dimensionner et déployer le cluster GPU sur OVHcloud : choix des instances et des cartes, arbitrages coût / mémoire / débit, réseau et stockage adaptés aux poids de modèles, le tout décrit en Terraform comme le reste de notre infrastructure.
- Industrialiser la couche GPU : drivers et pilotes CUDA, runtime conteneur GPU, opérateur GPU sur Kubernetes, partage et ordonnancement des cartes entre charges de travail, mise à l'échelle et extinction des ressources inutilisées.
- Opérer les serveurs d'inférence : déploiement et réglage de moteurs type vLLM ou équivalents, gestion du cycle de vie des modèles et de leurs versions, quantification, batching, mesure et optimisation de la latence et du débit.
- Exposer une passerelle LLM interne : API compatible avec les clients standards, authentification, quotas et suivi de consommation, journalisation
- pour les applications comme pour les outils de l'équipe.
- Construire les briques applicatives d'appui : embeddings et recherche vectorielle, chaînes de RAG sur nos référentiels et notre documentation, évaluation de la qualité des réponses.
- Garantir le cadre données de santé : isolation stricte des environnements, aucune donnée sortante, traçabilité des accès et des inférences, en lien avec la sécurité et la conformité.
- Observer et maîtriser les coûts : métriques GPU, saturation, taux d'occupation, coût par requête et par usage
- la sobriété fait partie du travail.
- Contribuer au socle commun : l'infrastructure GPU n'est pas une île, vous participez aussi à l'IaC, à la CI et au run de l'équipe.
Idéalement, vous avez ...
- Un diplôme d'ingénieur ou équivalent (Mathématique, Informatique, Santé publique, etc.)
- 3 ans d'expérience minimum en infrastructure, DevOps ou MLOps, dont une expérience significative sur des charges GPU. Un profil DevOps qui s'est spécialisé vers le GPU nous intéresse autant qu'un profil MLOps qui a gardé les mains dans l'infrastructure.Vous maitrisez :
- Une pratique réelle de Terra
Annonce publiée sur Jobmed et reprise par Intelligence Academy. Seule l'annonce d'origine fait foi ; nous ne sommes pas l'employeur.
Offres semblables
Développeur Java / Angular - IA - Freelance
Collective.work
- 8ème Arrondissement
- Freelance
Description du poste Taux journalier (TJM): 400 Contexte Le département Tech Expertise & Solutions a pour vocation d'accompagner la transformation digitale de nos métiers, en lien avec la stratégie d'un grand groupe bancaire. Ce centre d'expertise transverse est orienté développement, innovation, data, IA Prestation au
Tech Lead IA Junior (H/F)
Fed Group
- Paris
- 50 k€ – 60 k€ / an
Fed IT, cabinet entièrement dédié aux recrutements spécialisés sur les métiers de l'informatique (Infra, Data, Développement, MOA, MOE, Management), recherche pour un de ses clients dans le secteur de la santé basé à Paris, un ou une : Tech Lead IA Junior (H/F). Le poste est à pourvoir dans le cadre d'un CDI chez le cl
- Paris
- CDI
- 45 k€ / an
Salaire: 45ke Et si votre prochain projet faisait grandir vos compétences autant que votre carrière ? Chez K-LAGAN, nous faisons vivre chaque projet grâce aux talents qui le portent, en alliant expertise technique et accompagnement personnalisé. Aujourd'hui, nous recherchons un(e) Développeur(se) Full Stack à domin
Consultant SRE - IA - Freelance
Collective.work
- 8ème Arrondissement
- Freelance
Description du poste Taux journalier (TJM): ~600 Contexte Dans le cadre du développement et de l’industrialisation d’une plateforme dédiée à l’IA agentique, le consultant intégrera une équipe en charge du socle technique permettant de déployer, superviser et exploiter des agents IA en production. L’objectif de la missi
