Informations générales
Organisme de rattachement
Institut National de Recherche pour l'Agriculture, l'Alimentation et l'Environnement (INRAE)
Référence
INRAE-OT-30232
Date de début de diffusion
29/07/2026
Date de parution
09/09/2026
Date de fin de diffusion
15/09/2026
Description du poste
Versant
Fonction Publique de l'Etat
Nature de l'emploi
Emploi ouvert uniquement aux contractuels
Domaine / Métier
Numérique - Intégratrice / Intégrateur logiciel
Statut du poste
Vacant
Intitulé du poste
Ingénieur-e de développement Python – Écosystème sémantique & IA
Descriptif de l'employeur
L’Institut national de recherche pour l’agriculture, l’alimentation et l’environnement (INRAE) est un établissement public de recherche rassemblant une communauté de travail de 12 000 personnes, avec 272 unités de recherche, de service et expérimentales, implantées dans 18 centres sur toute la France. INRAE se positionne parmi les tout premiers leaders mondiaux en sciences agricoles et alimentaires, en sciences du végétal et de l’animal. Ses recherches visent à construire des solutions pour des agricultures multi-performantes, une alimentation de qualité et une gestion durable des ressources et des écosystèmes.
Description du poste
Le poste est rattaché à Direction pour la Science Ouverte (DipSO), une direction placée sous la responsabilité du Directeur général délégué Science et Innovation. La DipSO développe une offre de services, produit des études et des prototypes, conseille/forme les acteurs de la science et de la stratégie en matière de science ouverte et de numérique pour la science. Elle rassemble, pour ce faire, des compétences diverses, complémentaires (documentation, informatique, scientifique, data science) pour assurer ses services et gérer des projets sur l’ensemble de son périmètre. Elle est organisée en quatre pôles.
Son pôle Numérique pour la Science (Num4Sci) contribue à consolider la politique de l’établissement en matière de numérique scientifique, en assurant la mise à disposition d’outils et de services pour la science ouverte. Ces outils et services communs visent notamment à favoriser une pratique plus ouverte et collaborative de la science, et à permettre aux communautés scientifiques de profiter davantage des opportunités du numérique.
Vous serez accueilli(e) au sein de l’équipe Données et Sémantique (D&S) du pôle Num4Sci de la DipSO. L'équipe fonctionne en mode Agile Scrum et le poste requiert une forte capacité à collaborer à distance avec des interlocuteurs répartis sur toute la France. Au sein d’une équipe constituée d’ingénieurs en sémantique, en recherche d’information textuelle et spécialistes en IA, vous contribuerez à des projets dans le domaine en développant des workflow d’analyse de données et des outils, et en étant force de proposition sur les technologies et méthodes à utiliser. Vous évoluerez dans un environnement stimulant, à l’interface entre la recherche académique et les applications concrètes en sciences des données.
Votre mission consistera à mettre en œuvre des projets de développement de solutions applicatives visant à automatiser certaines tâches liées à l'administration des données scientifiques.
Ces applications (Python) exploiteront des algorithmes de machine learning ou de deep learning pour extraire l’information des productions scientifiques (articles, jeux de données), la structurer et la formaliser à l'aide de référentiels (structures, personnes, thématiques , mots clés...). En vous appuyant sur les connaissances métier de vos collègues, vous serez chargé de concevoir et développer des chaînes de traitement permettant par exemple :
- d’explorer le contenu d’articles scientifiques et d’en extraire de l’information,
- d’annoter et classifier ces articles selon les ontologies du domaine, ou les thésaurus
- de structurer leur contenu et leurs métadonnées pour les préparer aux requêtes des agents IA,
- d’enrichir et requêter des graphes de connaissance sémantiques,
Descriptif du profil recherché
Formation recommandée : Master/Ingénieur (Bac+5) École d’ingénieur ou Master avec spécialisation en informatique et/ou data science.
Compétences indispensables:
- Maîtrise solide du langage Python, de ses librairies et de son écosystème de développement
- Bases de données (Relationnelles, No-SQL), Graph (Neo4J, TripleStore...), Vectorielles (QDrant...) …
- Une première expérience avec Docker, Gitlab.
Connaissances souhaitées :
- Traitement des données textuelles et modèles de langue
- Sémantique, vocabulaires contrôlés et ontologies (RDF, SKOS, OWL)
- Sensibilité aux architectures de graphes de connaissances et à la manipulation d'ontologies ou de thésaurus.
- Intérêt pour l'exploitation des LLM, notamment open (frameworks d'orchestration, APIs) et les concepts de vectorisation (embeddings, reranking,...).
- Curiosité pour les protocoles modernes d'interopérabilité comme MCP (Model Context Protocol) ou le standard Croissant-ML.
- Langages documentaires (ex : thésaurus)
- Méthodes (par exemple Agile) et outils de gestion de projets
- Des connaissances dans le mise en place d’interfaces web (front)
- Connaissance de docker
- Initiation à Kubernetes.
Expérience appréciée :
- Participation à un projet de traitement de données non structurées (ex : documents PDF, images, textes bruts...).
- Mise en œuvre de modèles, NLP, ou LLM pour l’extraction d’information.
- Intégration de modèles ML/DL dans des pipelines de traitement (ETL, data pipelines).
- Déploiement de modèles sous forme d’API, idéalement dans des environnements conteneurisés (Docker, Kubernetes).
- Sensibilité aux problématiques de monitoring, versioning et dérive des modèles.
- Sensibilité à la qualité du code notamment la documentation technique
Aptitudes recherchées :
- autonomie, rigueur technique, adaptabilité et proactivité dans l'apprentissage de nouvelles technologies. De très bonnes capacités de communication (écrite et orale) sont indispensables pour la collaboration quotidienne au sein d'une équipe répartie à distance.
Le poste est basé à Toulouse. Il implique une collaboration quotidienne et essentielle avec des interlocuteurs (Product Owners, équipes partenaires, utilisateurs) situés à distance sur l'ensemble du territoire national.
Les candidats retenus seront auditionnés la semaine du 21 septembre (entretien d’une heure maximum en visio ou présentiel). Ils recevront un mail d’invitation à l’entretien 1 semaine à l’avance. Les candidats non convoqués au-delà de cette période pourront considérer leur candidature infructueuse.
Pays
Localisation du poste
Europe, France, Occitanie, Haute Garonne (31)
Géolocalisation du poste
31326 Castanet-Tolosan
Lieu d'affectation (sans géolocalisation)
Haute-Garonne
Critères candidat
Niveau d'études / Diplôme
Niveau 6 Licence/diplômes équivalents
Demandeur
Date de vacance de l'emploi
01/11/2026