Ingénieur d'études en développement orienté IA (H/F)
Référence : 2026-2380852
- Fonction publique : Fonction publique de l'État
- Employeur : Bibliothèque nationale de France (BNF)
- Localisation : Quai François Mauriac, 75013 Paris, France
Partager la page
Veuillez pour partager sur Facebook, Twitter et LinkedIn.
- Nature de l’emploi Emploi ouvert uniquement aux contractuels
-
Nature du contrat
CDD d'1 an
- Expérience souhaitée Non renseigné
-
Rémunération Fourchette indicative pour les contractuels 3 802€ et 4 563,42€ brut mensuel € brut/an Fourchette indicative pour les fonctionnaires Non renseignée
- Catégorie Catégorie A (cadre)
- Management Non renseigné
- Télétravail possible Non renseigné
Vos missions en quelques mots
Dans le cadre de cette dernière séquence du projet de recherche, l’ingénieur d’études, sous la responsabilité d’un expert responsable du projet, sera en charge de l’industrialisation du prototype dans l’écosystème technique de la BnF. Pour cela, l’ingénieur d’études :
• Contribue au déploiement des modèles constituant le prototype / pipeline sur les systèmes informatiques de la BnF ;
• Modélise les flux de fichiers entrants et sortants du pipeline ;
• Conçoit et implémente une architecture dédiée, et package le code selon une approche pré-production ;
• Met en place les tests nécessaires ;
• Travaille sur la conversion des exports (JSON) du pipeline en fichiers ALTO et METS, qui sont les formats traditionnellement exploités et archivés par la BnF ;
• Développe des outils de contrôle qualité du workflow mis en place, et évalue la pertinence des informations générées par les modèles ;
• Rédige la documentation technique afférente au prototype (manuel d’installation, DAT,…) ;
• Rédige un rapport final, à destination de l’ANR et du consortium du projet, sur l’utilisabilité du pipeline à l’échelle de collections variées et massives.
Profil recherché
• Excellentes pratiques du développement Python (objet, fonctionnel, scripting, API, workflows) appliquées au traitement de données documentaires et modèles de machine learning ;
• Expériences significatives dans le domaine du traitement de données documentaires massives (JSON, XML, formats et protocoles spécifiques, segmentation/océrisation, ALTO, METS), idéalement dans le domaine de la presse ;
• Maîtrise des environnements systèmes (Linux/Windows) et langages shell (bash) ;
• Capacité à tester et sécuriser son code ;
• Capacité à conceptualiser une architecture de traitement et la documenter dans des documentations spécifiques (DAT, schémas d’architecture,…) ;
• Capacité à documenter son code et ses environnements ;
• Connaissances théoriques sur le machine learning (principes de base);
• Capacités rédactionnelles, rigueur scientifique et esprit de synthèse ;
• Aisance relationnelle ;
• Capacité à rendre compte de son travail.
Compétences souhaitées
• Connaissances en ingénierie des modèles de machine learning (packaging et modularisation, FastAPI, OpenAPI,…), gestion des services, serveurs et infrastructures associés (vLLM, Ollama), logiques d’orchestration de jobs (Apache Airflow) ;
• Connaissances sur le monitoring (MLFlow) et la télémétrie spécifique de modèles de machine learning;
• Capacité à anticiper et apporter des solutions aux problématiques techniques (problème de charge, estimation de ressources de calcul, parallélisation et mise à l’échelle des ressources…) ;
• Capacité à concevoir, implémenter et améliorer des politiques d’évaluation qualitatives et quantitatives de modèles (mesures, comparatifs quantifiés de modèles et pipelines techniques) ;
• Pratiques éprouvées de la mise en production (CI/CD, versionnage de code selon des standards industriels, gestion des montées de version, release management) ;
• Connaissance des enjeux numériques des institutions patrimoniales.
Localisation
Qui sommes-nous ?
La BnF, ce sont sept sites en France et une grande diversité de métiers. Conservateurs, bibliothécaires, artisans d’art, ingénieurs, médiateurs, gestionnaires… tous réunis par une même passion du patrimoine et du service aux publics.
Établissement public sous tutelle du ministère de la Culture, la Bibliothèque nationale de France conserve et met à disposition de tous les publics l’un des fonds documentaires et patrimoniaux les plus riches du monde. Elle a pour mission de collecter, conserver, enrichir et communiquer le patrimoine documentaire national.
Ici, on conserve des livres bien sûr ! Mais les collections françaises, européennes et extra-européennes de la bibliothèque s’étendent des manuscrits jusqu’aux contenus audiovisuels en passant par les partitions de musique, les estampes, la photographie, les monnaies et les médailles, les cartes et les plans, les costumes de spectacles… et bien d’autres trésors encore. Elle gère le dépôt légal institué par François 1er en 1537, intégrant progressivement les nouveaux supports et médias, les objets numériques et le web.
Centre de recherche, d’étude et de culture connecté avec le monde, la BnF est l’héritière des collections royales constituées depuis le Moyen Âge, qui n’ont cessé de s’enrichir et de se diversifier à travers les siècles.
Elle développe des activités de recherche et de diffusion de la connaissance, grâce à l’organisation régulière d’expositions à destination du grand public et de nombreuses manifestations culturelles, conférences, colloques, concerts, sur ses sites et partout en France. Elle anime un réseau de coopération avec d’autres services documentaires en France et participe à différentes formes de coopération internationale.
La BnF accueille tous les publics et encourage chacun à faire le meilleur usage de ses collections, de ses espaces de travail, de lecture, de collaboration, de recherche et de culture. Elle met ses collections et ses solutions technologiques au service des chercheurs et des étudiants, mais aussi des passionnés, des simples curieux ou encore des jeunes publics et des familles.
La diversité des talents et des compétences qui animent au quotidien la Bnf est à l’image de la richesse de ses collections et de la multiplicité de ses ressources techniques et scientifiques.
Descriptif du service
Lauréat en 2023 de l’Appel à projets « Thématiques Spécifiques en Intelligence Artificielle » (TSIA) de l’Agence Nationale de la Recherche (ANR), le projet de recherche FINLAM (Foundation INtegrated models for Libraries Archives and Museums) vise à améliorer l’accès aux collections patrimoniales numérisées en développant des méthodes d’extraction des structures logiques de fascicules de presse. Il réunit un laboratoire de recherche (le Litis, de l’université de Rouen), la société Teklia, et la BnF. Il se propose de développer des modèles pour l’extraction d’informations de documents numérisés ou nés numériques. Eu égard aux formidables volumes des collections de presse numérisée de la BnF (8 millions de documents numérisés à date) et à l’intérêt toujours plus vif des chercheurs pour le matériau riche, mais encore difficilement accessible, que ces documents constituent, le projet FINLAM revêt une importance particulière pour la BnF.
Commencé en septembre 2023, d’une durée de 49 mois (fin fixée au 31 octobre 2027), ce projet abordera bientôt sa dernière séquence : l’industrialisation du prototype créé par le consortium du projet. Ce prototype est un pipeline permettant la segmentation et la transcription textuelle de fascicules de presse, puis l’extraction de leur structure logique (segmentation des articles) grâce à un chaînage de modèles d’IA. L’ambition est de mettre en production le pipeline de traitement des fascicules, et de le tester sur un ensemble conséquent de docum
À propos de l'offre
-
Nous vous remercions de bien vouloir candidater sur la page emploi.bnf.fr disponible en cliquant sur "Postuler sur site employeur".
-
L.332-24
-
Vacant à partir du 15/10/2026
-
Responsable d'études SI