Open Source - Red Hat IA Platform Engineer H/F 92 - Levallois-Perret
Offre n° 7419853
Open Source - Red Hat IA Platform Engineer H/F
92 - Levallois-Perret - Localiser avec Mappy
Publié le 26 septembre 2026
POSTE : Open Source - Red Hat IA Platform Engineer H/F DESCRIPTION : En 2026, l'enjeu de l'Intelligence Artificielle en entreprise a basculé du prototypage vers l'ingénierie d'infrastructure, le serving haute performance et la maîtrise des coûts GPU. En tant qu'AI Platform Engineer, vous serez au coeur de cette convergence entre Platform Engineering (Kubernetes / OpenShift) et LLMOps. Vous concevrez, déploierez et opérerez les plateformes industrielles permettant d'entraîner, fine-tuner, orchestrer et servir des modèles d'IA générative (LLM, SLM, vision) sécurisés et souverains. 1 Orchestration & Serving LLM Haute Performance (High-Throughput Inference) - Déployer, optimiser et opérer les moteurs d'inférence de pointe : vLLM (PagedAttention, Prefix Caching, continuous batching), LLMD, LiteLLM Proxy, SGLang, TGI et Triton Inference Server. - Implémenter des architectures de Multi-LoRA Serving (S-LoRA) pour mutualiser un modèle de fondation unique et servir à chaud des dizaines d'adaptateurs métier sur un même GPU. - Mettre en oeuvre le serving déclaratif serverless via KServe et ModelMesh sur Red Hat OpenShift AI (RHOAI). 2 Orchestration Matérielle, Batch Scheduling & GPU FinOps - Déployer et configurer le NVIDIA GPU Operator, la Container Device Interface (CDI) et la Dynamic Resource Allocation (DRA). - Maximiser l'utilisation de la VRAM via le découpage NVIDIA MIG (Multi-Instance GPU) et le vGPU time-slicing. - Déployer et configurer Kueue pour le batch scheduling multi-tenant, la gestion fine des files d'attente de jobs GPU (ClusterQueue / LocalQueue) et le fair-sharing des quotas de calcul entre équipes. - Bâtir des architectures d'autoscaling élastique pilotées par le KV-Cache et les métriques de requêtes en attente avec KEDA et Prometheus. 3 Frameworks Agentiques, Pipelines RAG & Écosystème Llama Stack - Standardiser les briques d'IA générative d'entreprise en déployant le Llama Stack Operator et l'interfaçage avec les APIs unifiées d'inférence, de sécurité et d'agents. - Industrialiser des architectures RAG avancées et des workflows multi-agents avec LangChain, LangGraph et LlamaIndex. - Déployer et opérer des bases de données vectorielles distribuées à haute résilience (Milvus Distributed, Qdrant, pgvector, ChromaDB) adossées à OpenShift Data Foundation (Ceph / ODF). - Déployer et sécuriser des passerelles Model Context Protocol (MCP) en environnement Zero-Trust. 4 Fine-Tuning Souverain & Calcul Distribué - Industrialiser les pipelines d'alignement et de fine-tuning open source avec InstructLab (méthode LAB) et RHEL AI sur modèles souverains et open-weights (IBM Granite 3.x, Mistral AI, Llama 3.x / 4, DeepSeek). - Orchestrer les entraînements et traitements distribués avec KubeRay, Ray Serve, Kueue et Kubeflow Pipelines. 5 Sécurité, Gouvernance & Observabilité (IA Act Ready) - Intégrer des garde-fous éthiques et de sécurité : NeMo Guardrails, TrustyAI (explicabilité et détection des biais). - Mettre en place l'observabilité LLMOps complète avec OpenTelemetry (suivi de la latence TTFT / TPOT, traçabilité des tokens, auditabilité et FinOps IA). - Automatiser l'ensemble de la stack en GitOps (ArgoCD / OpenShift GitOps) et Ansible Automation Platform. Ce que STARTX Part of Devoteam vous apporte : - Accès illimité aux formations & certifications : Abonnement personnel Red Hat Learning Subscription (RHLS Enterprise) avec passages d'examens - Environnements de pointe : Accès à de vrais clusters GPU d'expérimentation, des POCs clients ambitieux et une relation privilégiée avec les ingénieries de Red Hat, NVIDIA, IBM et Mistral AI. - Flexibilité & Qualité de vie : Télétravail hybride maîtrisé, locaux modernes et événements tech réguliers (Tech Days, Red Hat Summit, conférences). - Package complet : Rémunération attractive (fixe + variable), mutuelle d'entreprise de premier rang, carte ticket restaurant, indemnités télétravail et équipement matériel haut de gamme (MacBook Pro M-Series). PROFIL : Issu(e) d'une formation d'ingénieur ou équivalent (Bac +5), vous avez une expérience confirmée en ingénierie de plateformes Kubernetes/Cloud Native et êtes passionné(e) par l'écosystème de l'IA générative et du LLMOps. Compétences Techniques Clés : - Socle Plateforme & Conteneurs : Maîtrise approfondie de Kubernetes et Red Hat OpenShift (4.x), Operators (OLM), GitOps (ArgoCD), Linux/RHEL, Podman/Docker. - Plateformes & Frameworks IA : Expérience ou maîtrise de Red Hat OpenShift AI (RHOAI), vLLM, LLMD / LiteLLM, KServe, LangChain / LangGraph, LlamaIndex, Kueue, Kubeflow / Ray. - Accélération & Stockage : Notions solides sur les GPUs NVIDIA (GPU Operator, CUDA, MIG), stockage distribué pour l'IA (S3/Ceph/ODF) et bases vectorielles (Milvus, Qdrant, pgvector). - Développement & Automatisation : Python (PyTorch, SDKs IA, APIs FastAPI/REST), Bash, YAML, Ansible. - Une connaissance d'OpenClaw est un plus ! Certifications (Fortement valorisées) : - Red Hat Certified Specialist
- Type de contrat
-
CDI
Contrat travail - Durée du travail
-
35H/semaine
Profil souhaité
Expérience
- 8 An(s)Cette expérience est indispensable
Informations complémentaires
- Qualification : Cadre
- Secteur d'activité : Ingénierie,études techniques
Employeur
Devoteam France
Devoteam est un leader du conseil en stratégie digitale, plateformes technologiques, cybersécurité et transformation IA. Avec 11 000 collaborateurs en Europe, Moyen-Orient et Afrique, Devoteam met depuis 30 ans la Technologie au service de l'Homme et accélère la transition des grands comptes vers l'IA d'entreprise. Zoom sur STARTX Part of Devoteam, le Centre d'Excellence Cloud Native & IA Open Source de Devoteam. STARTX Part of Devoteam est l'élite Open Source et Cloud Native de Dev...
D'autres offres peuvent vous intéresser :
(déjà vu)
Ingénieur d'applications (Staff) (H/F)
PROPHESEE - 75 - PARIS 11
Ce poste d'expert s'adresse à un ingénieur alliant une expertise de niveau doctorat en physique et en capteurs neuromorphiques à une capacité concrète à appliquer ces connaissances dans des...
CDI - Temps plein
Publié il y a 2 jours
CDI
Temps plein(déjà vu)
ARCHITECTE JUNIOR AUTOCAD & REVIT (H/F)
TIM - 93 - NOISY-LE-GRAND
Notre client, bureau d'études et maître d'œuvre, expert dans les domaines de la Gestion de Projet et de l'Assistance à Maîtrise d'Ouvrage (AMO), recherche actuellement son/sa futur/e...
CDI - Temps plein
Publié il y a 8 jours
CDI
Temps plein
(déjà vu)Ingénieur DevOps Gcp H/F
LR Technologies - 92 - Bois-Colombes
POSTE : Ingénieur DevOps Gcp H/F DESCRIPTION : Au sein des équipes de notre client, acteur international des solutions connectées pour les télécoms et l'énergie, vous interviendrez sur les...
CDI - Non renseigné
Publié il y a 2 jours
CDI
Non renseigné
(déjà vu)Ingénieur DevOps H/F
Altim - 92 - Boulogne-Billancourt
POSTE : Ingénieur DevOps H/F DESCRIPTION : Nous recherchons un(e) ingénieur(e) DevOps expérimenté pour rejoindre une équipe d'ingénierie logicielle dédiée à l'innovation et à la fiabilité des...
CDI - Non renseigné
Publié il y a 2 jours
CDI
Non renseigné
(déjà vu)Ingénieurs de Production DevOps H/F
DCS Easyware - 75 - Paris 13e Arrondissement
POSTE : Ingénieurs de Production DevOps H/F DESCRIPTION : Dans le cadre du renforcement de nos équipes, DCS recrute plusieurs Ingénieurs de Production DevOps (H/F) pour intervenir auprès d'un acteur...
CDI - Non renseigné
Publié il y a 2 jours
CDI
Non renseigné
(déjà vu)Reconversion Informatique CDI - DevOps - Cloud Junior+ Cds H/F
Logwire Consulting - 92 - Asnières-sur-Seine
POSTE : Reconversion Informatique CDI - DevOps - Cloud Junior+ Cds H/F DESCRIPTION : Une société française recherche actuellement des profils techniques niveau Master 2 (M2) souhaitant évoluer vers...
CDI - Non renseigné
Publié il y a 2 jours
CDI
Non renseigné
(déjà vu)Ingénieur DevOps Expert en Automatisation Ansible H/F
AS International - 75 - Paris 13e Arrondissement
POSTE : Ingénieur DevOps Expert en Automatisation Ansible H/F DESCRIPTION : Nous recherchons pour le compte de notre client basé à Paris 13ème, un Ingénieur devOps (F/H) expert en automatisation...
CDI - Non renseigné
Publié il y a 2 jours
CDI
Non renseigné
(déjà vu)Lead DevOps H/F
Team.is - 75 - Paris 1er Arrondissement
POSTE : Lead DevOps H/F DESCRIPTION : Vous souhaitez rejoindre une structure à taille humaine intervenant sur des projets stratégiques de modernisation des systèmes d'information pour les...
CDI - Non renseigné
Publié il y a 2 jours
CDI
Non renseigné
(déjà vu)Ingénieur DevOps - Sre - Aéroline - Île-De-France H/F
Sopra Steria - 92 - Courbevoie
POSTE : Ingénieur DevOps - Sre - Aéroline - Île-De-France H/F DESCRIPTION : Au sein d'une équipe dynamique, agile et à taille humaine, vous évoluez dans un environnement technique riche et...
CDI - Non renseigné
Publié il y a 2 jours
CDI
Non renseigné
(déjà vu)Consultant Devsecops H/F
Inetum - 93 - Saint-Ouen-sur-Seine
POSTE : Consultant Devsecops H/F DESCRIPTION : Le groupe INETUM recrute des Consultants Sécurité Applicative pour renforcer son pôle d'expertise en cybersécurité et intervenir auprès de nos clients...
CDI - Non renseigné
Publié il y a 2 jours
CDI
Non renseigné
Découvrez d'autres services web

Réussir son CV et sa lettre de motivation
Suscitez l’intérêt du recruteur et donnez-lui envie de vous rencontrer.

B.A.BA Entretien
Apprenez à préparer votre prochain entretien.

Informations sur le marché du travail
Accédez aux informations et statistiques sur ce métier.

Simulateur en cas de reprise d'emploi salarié
Estimez vos droits aux allocations et aides.
- Voir plus de services (Emploi store)


.



