Ingénieur-e de développement Python – Écosystème sémantique & IA
Référence : 2026-2369110
- Fonction publique : Fonction publique de l'État
-
Employeur :
Institut National de Recherche pour l'Agriculture, l'Alimentation et l'Environnement (INRAE)
Inrae - Localisation : 31326 Castanet-Tolosan
Partager la page
Veuillez pour partager sur Facebook, Twitter et LinkedIn.
- Nature de l’emploi Emploi ouvert uniquement aux contractuels
-
Nature du contrat
CDD d'1 an
- Expérience souhaitée Non renseigné
-
Rémunération Fourchette indicative pour les contractuels Entre 2244€ et 3330€ brut/mois € brut/an Fourchette indicative pour les fonctionnaires Non renseignée
- Catégorie Catégorie A (cadre)
- Management Non renseigné
- Télétravail possible Non renseigné
Vos missions en quelques mots
Vous serez accueilli(e) au sein de l’équipe Données et Sémantique (D&S) du pôle Num4Sci de la DipSO. L'équipe fonctionne en mode Agile Scrum et le poste requiert une forte capacité à collaborer à distance avec des interlocuteurs répartis sur toute la France. Au sein d’une équipe constituée d’ingénieurs en sémantique, en recherche d’information textuelle et spécialistes en IA, vous contribuerez à des projets dans le domaine en développant des workflow d’analyse de données et des outils, et en étant force de proposition sur les technologies et méthodes à utiliser. Vous évoluerez dans un environnement stimulant, à l’interface entre la recherche académique et les applications concrètes en sciences des données.
Votre mission consistera à mettre en œuvre des projets de développement de solutions applicatives visant à automatiser certaines tâches liées à l'administration des données scientifiques.
Ces applications (Python) exploiteront des algorithmes de machine learning ou de deep learning pour extraire l’information des productions scientifiques (articles, jeux de données), la structurer et la formaliser à l'aide de référentiels (structures, personnes, thématiques , mots clés...). En vous appuyant sur les connaissances métier de vos collègues, vous serez chargé de concevoir et développer des chaînes de traitement permettant par exemple :
– d’explorer le contenu d’articles scientifiques et d’en extraire de l’information,
– d’annoter et classifier ces articles selon les ontologies du domaine, ou les thésaurus
– de structurer leur contenu et leurs métadonnées pour les préparer aux requêtes des agents IA,
– d’enrichir et requêter des graphes de connaissance sémantiques,
Profil recherché
Formation recommandée : Master/Ingénieur (Bac+5) École d’ingénieur ou Master avec spécialisation en informatique et/ou data science.
Compétences indispensables :
Maîtrise solide du langage Python, de ses librairies et de son écosystème de développement
Bases de données (Relationnelles, No-SQL), Graph (Neo4J, TripleStore...), Vectorielles (QDrant...) …
Une première expérience avec Docker, Gitlab.
Connaissances souhaitées :
Traitement des données textuelles et modèles de langue
Sémantique, vocabulaires contrôlés et ontologies (RDF, SKOS, OWL)
Sensibilité aux architectures de graphes de connaissances et à la manipulation d'ontologies ou de thésaurus.
Intérêt pour l'exploitation des LLM, notamment open (frameworks d'orchestration, APIs) et les concepts de vectorisation (embeddings, reranking,...).
Curiosité pour les protocoles modernes d'interopérabilité comme MCP (Model Context Protocol) ou le standard Croissant-ML.
Langages documentaires (ex : thésaurus)
Méthodes (par exemple Agile) et outils de gestion de projets
Des connaissances dans le mise en place d’interfaces web (front)
Connaissance de docker
Initiation à Kubernetes.
Expérience appréciée :
Participation à un projet de traitement de données non structurées (ex : documents PDF, images, textes bruts...).
Mise en œuvre de modèles, NLP, ou LLM pour l’extraction d’information.
Intégration de modèles ML/DL dans des pipelines de traitement (ETL, data pipelines).
Déploiement de modèles sous forme d’API, idéalement dans des environnements conteneurisés (Docker, Kubernetes).
Sensibilité aux problématiques de monitoring, versioning et dérive des modèles.
Sensibilité à la qualité du code notamment la documentation technique
Aptitudes recherchées :
autonomie, rigueur technique, adaptabilité et proactivité dans l'apprentissage de nouvelles technologies. De très bonnes capacités de communication (écrite et orale) sont indispensables pour la collaboration quotidienne au sein d'une équipe répartie à distance.
Le poste est basé à Toulouse. Il implique une collaboration quotidienne et essentielle avec des interlocuteurs (Product Owners, équipes partenaires, utilisateurs) situés à distance sur l'ensemble du territoire national.
Niveau d'études minimum requis
- Niveau Niveau 7 Master/diplômes équivalents
Éléments de candidature
Personnes à contacter
- Sophie Aubin
- Eric Cahuzac
Qui sommes-nous ?
NOTRE AMBITION : AGIR POUR LA VIE, L’HUMAIN, LA TERRE
Premier organisme de recherche spécialisé au monde en agriculture, alimentation et environnement, INRAE est né le 1er janvier 2020 de de la fusion entre l’INRA et IRSTEA. Nous sommes une communauté de travail de 12 000 personnes, avec plus de 200 unités de recherche et une quarantaine d’unités expérimentales implantées dans 18 centres sur toute la France.
Notre Mission ?
Face à l’augmentation de la population, au changement climatique, à la raréfaction des ressources et au déclin de la biodiversité, INRAE construit des solutions pour des agricultures multi-performantes, une alimentation de qualité et une gestion durable des ressources.
Pour répondre à ces grands enjeux mondiaux, nous avons besoin de renfort dans nos équipes. Des métiers de la recherche aux métiers de l’appui, l’INRAE recrute à tout niveau de diplôme (du CAP/BEP à Bac+8) !
Rejoignez une communauté engagée et agissez pour l’intérêt général !
Descriptif du service
Le poste est rattaché à Direction pour la Science Ouverte (DipSO), une direction placée sous la responsabilité du Directeur général délégué Science et Innovation. La DipSO développe une offre de services, produit des études et des prototypes, conseille/forme les acteurs de la science et de la stratégie en matière de science ouverte et de numérique pour la science. Elle rassemble, pour ce faire, des compétences diverses, complémentaires (documentation, informatique, scientifique, data science) pour assurer ses services et gérer des projets sur l’ensemble de son périmètre. Elle est organisée en quatre pôles.
Son pôle Numérique pour la Science (Num4Sci) contribue à consolider la politique de l’établissement en matière de numérique scientifique, en assurant la mise à disposition d’outils et de services pour la science ouverte. Ces outils et services communs visent notamment à favoriser une pratique plus ouverte et collaborative de la science, et à permettre aux communautés scientifiques de profiter davantage des opportunités du numérique.
À propos de l'offre
-
Les candidats retenus seront auditionnés la semaine du 21 septembre (entretien d’une heure maximum en visio ou présentiel). Ils recevront un mail d’invitation à l’entretien 1 semaine à l’avance. Les candidats non convoqués au-delà de cette période pourront considérer leur candidature infructueuse.
-
VOTRE QUALITE DE VIE À INRAE
En rejoignant INRAE, vous pourrez bénéficier selon le type de contrat :
- jusqu’à 30 jours de congés + 15 RTT par an (pour un temps plein)
- d'un soutien à la parentalité : CESU garde d'enfants, prestations pour les loisirs ;
- de dispositifs de développement des compétences : formation, conseil en orientation professionnelle ;
- d'un accompagnement social : conseil et écoute, aides et prêts sociaux ;
- de prestations vacances et loisirs : chèque-vacances, hébergements à tarif préférentiel ;
- d'activités sportives et culturelles ;
- d'une restauration collective.
-
Vacant à partir du 01/11/2026
-
Data engineer