
Open Source / Red Hat IA Platform Engineer (H/F)
- Kubernetes
- OpenShift
- AI
- vLLM
- Triton
- LoRA
- Red Hat OpenShift
- FinOps
- Prometheus
- RAG
- LangChain
- LangGraph
- LlamaIndex
- Milvus
- Qdrant
- pgvector
- Chroma
- Ceph
- Model Context Protocol
- MCP
- Zero Trust
- RHEL
- Ray
- Kubeflow
- OpenTelemetry
- GitOps
- ArgoCD
- Ansible
- Linux
- Podman
- Docker
- CUDA
- Python
- PyTorch
- FastAPI
- Bash
- YAML
- AI/ML
- CKA
Devoteam est un leader du conseil en stratĂ©gie digitale, plateformes technologiques, cybersĂ©curitĂ© et transformation IA. Avec 11 000 collaborateurs en Europe, Moyen-Orient et Afrique, Devoteam met depuis 30 ans la Technologie au service de lâHomme et accĂ©lĂšre la transition des grands comptes vers l'IA d'entreprise.
đŻ Zoom sur STARTX | Part of Devoteam, le Centre d'Excellence Cloud Native & IA Open Source de Devoteam.
STARTX | Part of Devoteam est l'élite Open Source et Cloud Native de Devoteam. Premier et partenaire historique Red Hat en France (depuis plus de 20 ans), STARTX rassemble des architectes et consultants de référence intervenant sur les architectures les plus critiques du marché (Kubernetes, OpenShift, automatisation, souveraineté numérique et plateformes d'IA générative).
Rejoindre STARTX | Part of Devoteam, câest vivre lâagilitĂ© et lâexigence technique dâune boutique dâingĂ©nierie dâĂ©lite, adossĂ©e Ă lâenvergure, aux moyens GPU et aux projets dâinnovation majeurs du groupe Devoteam.
En 2026, lâenjeu de lâIntelligence Artificielle en entreprise a basculĂ© du prototypage vers lâingĂ©nierie dâinfrastructure, le serving haute performance et la maĂźtrise des coĂ»ts GPU.
Â
En tant qu'AI Platform Engineer, vous serez au cĆur de cette convergence entre Platform Engineering (Kubernetes / OpenShift) et LLMOps. Vous concevrez, dĂ©ploierez et opĂ©rerez les plateformes industrielles permettant d'entraĂźner, fine-tuner, orchestrer et servir des modĂšles d'IA gĂ©nĂ©rative (LLM, SLM, vision) sĂ©curisĂ©s et souverains.
Â
1ïžâŁ Orchestration & Serving LLM Haute Performance (High-Throughput Inference)
Déployer, optimiser et opérer les moteurs d'inférence de pointe : vLLM (PagedAttention, Prefix Caching, continuous batching), LLMD, LiteLLM Proxy, SGLang, TGI et Triton Inference Server.
ImplĂ©menter des architectures de Multi-LoRA Serving (S-LoRA) pour mutualiser un modĂšle de fondation unique et servir Ă chaud des dizaines d'adaptateurs mĂ©tier sur un mĂȘme GPU.
Mettre en Ćuvre le serving dĂ©claratif serverless via KServe et ModelMesh sur Red Hat OpenShift AI (RHOAI).
2ïžâŁ Orchestration MatĂ©rielle, Batch Scheduling & GPU FinOps
Déployer et configurer le NVIDIA GPU Operator, la Container Device Interface (CDI) et la Dynamic Resource Allocation (DRA).
Maximiser l'utilisation de la VRAM via le découpage NVIDIA MIG (Multi-Instance GPU) et le vGPU time-slicing.
Déployer et configurer Kueue pour le batch scheduling multi-tenant, la gestion fine des files d'attente de jobs GPU (ClusterQueue / LocalQueue) et le fair-sharing des quotas de calcul entre équipes.
BĂątir des architectures d'autoscaling Ă©lastique pilotĂ©es par le KV-Cache et les mĂ©triques de requĂȘtes en attente avec KEDA et Prometheus.
3ïžâŁ Frameworks Agentiques, Pipelines RAG & ĂcosystĂšme Llama Stack
Standardiser les briques d'IA générative d'entreprise en déployant le Llama Stack Operator et l'interfaçage avec les APIs unifiées d'inférence, de sécurité et d'agents.
Industrialiser des architectures RAG avancées et des workflows multi-agents avec LangChain, LangGraph et LlamaIndex.
Déployer et opérer des bases de données vectorielles distribuées à haute résilience (Milvus Distributed, Qdrant, pgvector, ChromaDB) adossées à OpenShift Data Foundation (Ceph / ODF).
Déployer et sécuriser des passerelles Model Context Protocol (MCP) en environnement Zero-Trust.
4ïžâŁ Fine-Tuning Souverain & Calcul DistribuĂ©
Industrialiser les pipelines d'alignement et de fine-tuning open source avec InstructLab (méthode LAB) et RHEL AI sur modÚles souverains et open-weights (IBM Granite 3.x, Mistral AI, Llama 3.x / 4, DeepSeek).
Orchestrer les entraßnements et traitements distribués avec KubeRay, Ray Serve, Kueue et Kubeflow Pipelines.
5ïžâŁ SĂ©curitĂ©, Gouvernance & ObservabilitĂ© (IA Act Ready)
Intégrer des garde-fous éthiques et de sécurité : NeMo Guardrails, TrustyAI (explicabilité et détection des biais).
Mettre en place l'observabilité LLMOps complÚte avec OpenTelemetry (suivi de la latence TTFT / TPOT, traçabilité des tokens, auditabilité et FinOps IA).
Automatiser l'ensemble de la stack en GitOps (ArgoCD / OpenShift GitOps) et Ansible Automation Platform.
Issu(e) dâune formation dâingĂ©nieur ou Ă©quivalent (Bac+5), vous avez une expĂ©rience confirmĂ©e en ingĂ©nierie de plateformes Kubernetes/Cloud Native et ĂȘtes passionnĂ©(e) par l'Ă©cosystĂšme de l'IA gĂ©nĂ©rative et du LLMOps.
đ ïž CompĂ©tences Techniques ClĂ©s :
Socle Plateforme & Conteneurs : MaĂźtrise approfondie de Kubernetes et Red Hat OpenShift (4.x), Operators (OLM), GitOps (ArgoCD), Linux/RHEL, Podman/Docker.
Plateformes & Frameworks IA : Expérience ou maßtrise de Red Hat OpenShift AI (RHOAI), vLLM, LLMD / LiteLLM, KServe, LangChain / LangGraph, LlamaIndex, Kueue, Kubeflow / Ray.
Accélération & Stockage : Notions solides sur les GPUs NVIDIA (GPU Operator, CUDA, MIG), stockage distribué pour l'IA (S3/Ceph/ODF) et bases vectorielles (Milvus, Qdrant, pgvector).
Développement & Automatisation : Python (PyTorch, SDKs IA, APIs FastAPI/REST), Bash, YAML, Ansible.
Une connaissance d'OpenClaw est un plus !
đ Certifications (Fortement valorisĂ©es) :
Red Hat Certified Specialist in AI/ML (EX267) ou OpenShift Administration (EX280 / EX380 / EX288).
CKA (Certified Kubernetes Administrator) / CKAD.
đĄ Soft Skills :
Rigueur d'ingénierie, curiosité pour les derniÚres avancées open source (papers, nouveaux modÚles, runtimes).
Capacité à vulgariser des architectures d'IA complexes auprÚs de décideurs et d'équipes de Data Science.
Esprit d'équipe, autonomie et goût pour les projets d'innovation à fort impact.
Â
  Ce que STARTX | Part of Devoteam vous apporte :
đ AccĂšs illimitĂ© aux formations & certifications : Abonnement personnel Red Hat Learning Subscription (RHLS Enterprise) avec passages d'examensÂ
⥠Environnements de pointe : AccÚs à de vrais clusters GPU d'expérimentation, des POCs clients ambitieux et une relation privilégiée avec les ingénieries de Red Hat, NVIDIA, IBM et Mistral AI.
đĄ FlexibilitĂ© & QualitĂ© de vie : TĂ©lĂ©travail hybride maĂźtrisĂ©, locaux modernes et Ă©vĂ©nements tech rĂ©guliers (Tech Days, Red Hat Summit, confĂ©rences).
đŒ Package complet : RĂ©munĂ©ration attractive (fixe + variable), mutuelle dâentreprise de premier rang, carte ticket restaurant, indemnitĂ©s tĂ©lĂ©travail et Ă©quipement matĂ©riel haut de gamme (MacBook Pro M-Series).
Open Source / Red Hat IA Platform Engineer (H/F) · Devoteam