Ingénieure / Ingénieur DevOps SRE Socle IA
Référence : 2026-2381740
- Fonction publique : Fonction publique de l'État
-
Employeur :
Secrétariat Général
Direction de programme IA - Localisation : Ministère de la Justice, 35 rue de la gare 75019, Paris
Partager la page
Veuillez pour partager sur Facebook, Twitter et LinkedIn.
- Nature de l’emploi Emploi ouvert aux titulaires et aux contractuels
- Expérience souhaitée Non renseigné
-
Rémunération Fourchette indicative pour les contractuels Non renseignée Fourchette indicative pour les fonctionnaires Non renseignée
- Catégorie Catégorie A (cadre)
- Management Non
- Télétravail possible Oui
Vos missions en quelques mots
Vos activités principales
Vous n'avez jamais hébergé de modèle d'IA ni administré de cluster GPU ? Ce n'est pas un obstacle. Nous cherchons avant tout un socle Ops solide - conteneurisation, orchestration, CI/CD, observabilité, sécurisation d'infrastructure - et une réelle envie de monter en compétence sur l'exploitation des modèles IA voir "3. Profil recherché".
Missions
En tant qu'ingénieur ou ingénieure DevOps / SRE au sein de la DPIA, vous serez en charge de :
· Construire et opérer l'infrastructure du socle IA : hébergement et déploiement des briques d'inférence, de service de modèles et de RAG, en conteneurs sur un orchestrateur (Kubernetes / OpenShift)
· Industrialiser les déploiements : chaînes CI/CD, automatisation des mises en production, gestion des environnements, infrastructure as code
· Assurer le passage à l'échelle et la disponibilité du socle pour des services à destination de 90 000 agents : dimensionnement, auto-scaling, gestion de la charge et des pics d'usage
· Éprouver la tenue à la charge du socle par des campagnes de tests de charge, avant mise en production comme lors des montées en charge successives
· Mettre en place et faire vivre l'observabilité : journalisation, métriques, traces, tableaux de bord et alerting, aussi bien sur l'infrastructure que sur les usages des modèles (latence, débit, consommation, erreurs)
· Sécuriser l'infrastructure : gestion des rôles et des permissions, cloisonnement des flux, networking, gestion des secrets, application des exigences de sécurité du Ministère
· Contribuer à la fiabilité opérationnelle : traitement des incidents, analyse post-mortem, amélioration continue de la robustesse du socle
· Documenter et outiller l'équipe : rendre le socle exploitable et compréhensible par les développeurs qui construisent les solutions métiers au-dessus
L'équipe ayant vocation à grandir, vous contribuerez également à définir les pratiques d'exploitation et les standards d'industrialisation au fur et à mesure de son renforcement. Une partie de vos missions s’exerceront en lien avec la direction du numérique (DNUM).
Profil recherché
Connaissances
Hébergement et déploiement cloud, conteneurisation (Docker ou équivalent) et orchestration (Kubernetes, OpenShift)
Passage à l'échelle : dimensionnement, auto-scaling (horizontal et vertical), optimisation des ressources
Tests de charge : conception de scénarios représentatifs, mesure des limites du service et exploitation des résultats pour dimensionner l'infrastructure (k6, Locust, JMeter ou équivalents)
Chaînes CI/CD : automatisation des builds, tests et déploiements, stratégies de livraison (GitOps, déploiement progressif)
Exploitation de ressources GPU pour l'inférence IA (appréciée, non exigée) : configuration, opération et optimisation de GPU - pilotes et runtime CUDA, serveurs d'inférence (vLLM ou équivalents)
Savoir-être
Curiosité technique et envie d'apprendre : l'IA est un domaine en évolution rapide, vous serez amené·e à monter en compétence sur l'inférence, le service de modèles et les architectures RAG
Rigueur et attachement aux bonnes pratiques de l'industrie
Culture du service rendu : vous concevez le socle comme un produit au service des équipes qui l'utilisent
Sens du collectif : l'équipe privilégie la collaboration et les décisions partagées entre PM, design et tech
Autonomie et capacité d'ownership : vous vous sentez responsable de votre périmètre, de la conception à l'exploitation
Regard critique et proactivité - vous challengez vos propres pratiques comme celles de l'équipe pour améliorer en continu la plateforme
Savoir-faire
Observabilité : journalisation, supervision, métriques, traces et alerting, avec les outils de l'écosystème (Grafana, ELK, Prometheus, OpenTelemetry ou équivalents)
Infrastructure as code : description d'infrastructure sous la forme de code de configuration déclarative (Terraform, Helm ou équivalents)
Sécurisation d'infrastructure : gestion des rôles et permissions (RBAC), politiques réseau et cloisonnement des flux, gestion des secrets
Aisance en scripting et en automatisation (Python ou équivalent)
Hébergement de modèles IA : montée en compétence attendue
Le socle repose sur l'hébergement de modèles de langage et l'exploitation de ressources GPU. Une expérience préalable sur ces sujets n'est pas exigée : nous sommes ouverts à un profil Ops solide qui n'a jamais administré de cluster GPU ni servi de modèles en production.
En revanche, nous attendons une volonté forte et démontrée de monter en compétence sur ces sujets (serveurs d'inférence, gestion de ressources GPU, spécificités opérationnelles des charges IA). Cette capacité sera évaluée en entretien.
Expériences professionnelles antérieures souhaitées
Expérience
Minimum 5 ans d'expérience en tant qu'Ops, DevOps, SRE ou Ingénieur·e plateforme
Expérience confirmée en conteneurisation et en orchestration : Kubernetes ou OpenShift en production, sur un périmètre dont vous étiez responsable
Éléments de candidature
Personnes à contacter
- romaric.haldenwang@justice.gouv.fr
- loic.poirier@justice.gouv.fr
Qui sommes-nous ?
La direction de programme intelligence artificielle (DPIA) est une direction du ministère de la Justice rattachée au secrétariat général. Elle coordonne le déploiement de l'intelligence artificielle au sein du ministère.
Son équipe Produit & Tech, créée il y a moins d'un an, opère et fait évoluer deux briques complémentaires :
– Un socle ministériel de solutions IA (inférence, hébergement de modèles, tools, RAG) mutualisé pour l'ensemble des besoins IA de la Justice.
– Des solutions métiers construites sur ce socle : Mon Assistant Justice (MAJ), agent conversationnel LLM sécurisé mis à disposition de 90 000 agents du Ministère.[EF1]
L'équipe est organisée en mode Produit : une approche centrée sur les besoins utilisateurs, avec des cycles de livraison courts, une PM dédiée et une autonomie forte de l'équipe technique dans les choix de conception et de priorisation. Les développements s'inscrivent dans une démarche open-source. L'objectif est de participer activement à la transformation des pratiques du Ministère par le numérique et de simplifier la vie des agents au quotidien.
Le déploiement des premières solutions n'est que la première étape d'un plan de transformation ambitieux et plus global, qui couvre l'ensemble des besoins de la Justice en matière d'IA. La mutualisation de ces besoins au sein d'un socle technique commun
Descriptif du service
Elle propose aux instances de gouvernance les décisions d’investissement et les projets à lancer. Elle fédère autour de cette stratégie les services et directions du ministère, et s’assure de leur participation à sa réalisation.
Elle s’assure au quotidien que les produits IA, ceux qu’elle porte directement et ceux portés par d’autres équipes du ministère, à qui elle apporte soutien et expertise, sont créés et évoluent dans un souci d’efficience globale, apportent bien la valeur attendue notamment pour les agents du ministère, et respectent les impératifs de performance, de conformité réglementaire, de sécurité et de souveraineté.
Elle définit et conduit une stratégie pour la montée en compétence des agents du ministère sur l’IA, et veille à la bonne adéquation des produits IA aux besoins de ces utilisateurs. La direction de programme assure le secrétariat de l’observatoire de l’IA, instance distincte qui sera chargée d’accompagner la mise en œuvre de la stratégie du ministère en la matière.
L’équipe Produit & Tech de la direction de programme opère notamment Mon Assistant Justice, un agent conversationnel fondé sur un grand modèle de langage (LLM), sécurisé et généraliste, mis à disposition des agents du ministère. Elle est organisée en mode produit : une approche centrée sur les besoins des utilisateurs, avec des cycles de livraison courts, une cheffe de produit dédiée et une forte autonomie de l’équipe technique dans les choix de conception et de priorisation.
À propos de l'offre
-
Poste nécessitant une enquête administrative de sécurité
Organisation de travail : télétravail possible 3 jours par semaine
Rémunération attractive – selon profil, avec prise en compte de la rémunération antérieure. Possibilité d’un contrat à durée indéterminée (CDI)
Restauration : oui (restaurant administratif)
Accessibilité en transport / Parking : Rosa Parks : transports en commun (RER E Rosa Parks, T3b, M12 Front populaire, M7 Corentin Cariou puis navette fluviale, bus 35 et 239) / Parking possible sur demande
-
Vacant à partir du 01/12/2026
-
Data engineer