Ingénieur-e de développement Python – Écosystème sémantique & IA

Détail de l'offre

Informations générales

Organisme de rattachement

Institut National de Recherche pour l'Agriculture, l'Alimentation et l'Environnement (INRAE)  

Référence

2026-2369110  

Date de début de diffusion

30/07/2026

Date de parution

30/07/2026

Intitulé long de l'offre

Ingénieur-e de développement Python – Écosystème sémantique & IA

Date limite de candidature

15/09/2026

Employeur

Inrae

Nature du contrat

CDD d'1 an

Description du poste

Versant

Fonction Publique de l'Etat

Catégorie

Catégorie A (cadre)

Nature de l'emploi

Emploi ouvert uniquement aux contractuels

Domaine / Métier

Numérique - Data engineer

Statut du poste

Vacant

Intitulé du poste

Ingénieur-e de développement Python – Écosystème sémantique & IA

Descriptif de l'employeur

INRAE, Institut national de recherche pour l’agriculture, l’alimentation et l’environnement, est un organisme public de recherche qui réunit 12 000 collaborateurs au sein de 272 unités réparties sur 18 centres en France. Premier organisme mondial spécialisé sur l’ensemble agriculture – alimentation – environnement, INRAE joue un rôle clé pour accompagner les transitions nécessaires face aux grands défis planétaires.

 

Face à l’augmentation de la population, aux enjeux de sécurité alimentaire, au changement climatique, à la raréfaction des ressources et au déclin de la biodiversité, INRAE s’engage à développer des solutions scientifiques et à accompagner l’évolution des pratiques agricoles, alimentaires et environnementales.

Descriptif du service

Le poste est rattaché à Direction pour la Science Ouverte (DipSO), une direction placée sous la responsabilité du Directeur général délégué Science et Innovation. La DipSO développe une offre de services, produit des études et des prototypes, conseille/forme les acteurs de la science et de la stratégie en matière de science ouverte et de numérique pour la science. Elle rassemble, pour ce faire, des compétences diverses, complémentaires (documentation, informatique, scientifique, data science) pour assurer ses services et gérer des projets sur l’ensemble de son périmètre. Elle est organisée en quatre pôles.

 

Son pôle Numérique pour la Science (Num4Sci) contribue à consolider la politique de l’établissement en matière de numérique scientifique, en assurant la mise à disposition d’outils et de services pour la science ouverte. Ces outils et services communs visent notamment à favoriser une pratique plus ouverte et collaborative de la science, et à permettre aux communautés scientifiques de profiter davantage des opportunités du numérique.

Description du poste

Vous serez accueilli(e) au sein de l’équipe Données et Sémantique (D&S) du pôle Num4Sci de la DipSO. L'équipe fonctionne en mode Agile Scrum et le poste requiert une forte capacité à collaborer à distance avec des interlocuteurs répartis sur toute la France. Au sein d’une équipe constituée d’ingénieurs en sémantique, en recherche d’information textuelle et spécialistes en IA, vous contribuerez à des projets dans le domaine en développant des workflow d’analyse de données et des outils, et en étant force de proposition sur les technologies et méthodes à utiliser. Vous évoluerez dans un environnement stimulant, à l’interface entre la recherche académique et les applications concrètes en sciences des données.

 

Votre mission consistera à mettre en œuvre des projets de développement de solutions applicatives visant à automatiser certaines tâches liées à l'administration des données scientifiques.

Ces applications (Python) exploiteront des algorithmes de machine learning ou de deep learning pour extraire l’information des productions scientifiques (articles, jeux de données), la structurer et la formaliser à l'aide de référentiels (structures, personnes, thématiques , mots clés...). En vous appuyant sur les connaissances métier de vos collègues, vous serez chargé de concevoir et développer des chaînes de traitement permettant par exemple :

–      d’explorer le contenu d’articles scientifiques et d’en extraire de l’information,

–      d’annoter et classifier ces articles selon les ontologies du domaine, ou les thésaurus

–      de structurer leur contenu et leurs métadonnées pour les préparer aux requêtes des agents IA,

–      d’enrichir et requêter des graphes de connaissance sémantiques,

Conditions particulières d'exercice

VOTRE QUALITE DE VIE À INRAE

 

En rejoignant INRAE, vous pourrez bénéficier selon le type de contrat :

 

- jusqu’à 30 jours de congés + 15 RTT par an (pour un temps plein)

- d'un soutien à la parentalité : CESU garde d'enfants, prestations pour les loisirs ;

- de dispositifs de développement des compétences : formation, conseil en orientation professionnelle ;

- d'un accompagnement social : conseil et écoute, aides et prêts sociaux ;

- de prestations vacances et loisirs : chèque-vacances, hébergements à tarif préférentiel ;

- d'activités sportives et culturelles ;

- d'une restauration collective.

Descriptif du profil recherché

Formation recommandée : Master/Ingénieur (Bac+5) École d’ingénieur ou Master avec spécialisation en informatique et/ou data science.

Compétences indispensables :

Maîtrise solide du langage Python, de ses librairies et de son écosystème de développement
Bases de données (Relationnelles, No-SQL), Graph (Neo4J, TripleStore...), Vectorielles (QDrant...) …
Une première expérience avec Docker, Gitlab.
 
Connaissances souhaitées :

Traitement des données textuelles et modèles de langue
Sémantique, vocabulaires contrôlés et ontologies (RDF, SKOS, OWL)
Sensibilité aux architectures de graphes de connaissances et à la manipulation d'ontologies ou de thésaurus.
Intérêt pour l'exploitation des LLM, notamment open (frameworks d'orchestration, APIs) et les concepts de vectorisation (embeddings, reranking,...).
Curiosité pour les protocoles modernes d'interopérabilité comme MCP (Model Context Protocol) ou le standard Croissant-ML.
Langages documentaires (ex : thésaurus)
Méthodes (par exemple Agile) et outils de gestion de projets
Des connaissances dans le mise en place d’interfaces web (front)
Connaissance de docker
Initiation à Kubernetes.
 

Expérience appréciée :

Participation à un projet de traitement de données non structurées (ex : documents PDF, images, textes bruts...).
Mise en œuvre de modèles, NLP, ou LLM pour l’extraction d’information.
Intégration de modèles ML/DL dans des pipelines de traitement (ETL, data pipelines).
Déploiement de modèles sous forme d’API, idéalement dans des environnements conteneurisés (Docker, Kubernetes).
Sensibilité aux problématiques de monitoring, versioning et dérive des modèles.
Sensibilité à la qualité du code notamment la documentation technique
 

Aptitudes recherchées :

autonomie, rigueur technique, adaptabilité et proactivité dans l'apprentissage de nouvelles technologies. De très bonnes capacités de communication (écrite et orale) sont indispensables pour la collaboration quotidienne au sein d'une équipe répartie à distance.
 

Le poste est basé à Toulouse. Il implique une collaboration quotidienne et essentielle avec des interlocuteurs (Product Owners, équipes partenaires, utilisateurs) situés à distance sur l'ensemble du territoire national.

Temps plein

Oui

Rémunération contractuels (en € brut/an)

Entre 2244€ et 3330€ brut/mois

Informations complémentaires

Informations complémentaires

Les candidats retenus seront auditionnés la semaine du 21 septembre (entretien d’une heure maximum en visio ou présentiel). Ils recevront un mail d’invitation à l’entretien 1 semaine à l’avance.  Les candidats non convoqués au-delà de cette période pourront considérer leur candidature infructueuse.

Pays

Localisation du poste

Europe, France, Occitanie, Haute Garonne (31)

Lieu d'affectation (sans géolocalisation)

31326 Castanet-Tolosan

Critères candidat

Niveau d'études / Diplôme

Niveau 7 Master/diplômes équivalents

Demandeur

Date de vacance de l'emploi

01/11/2026

Mail à qui adresser les candidatures (bouton postuler)

- sophie.aubin@inrae.fr - eric.cahuzac@inrae.fr

Contact 1

Sophie Aubin

Contact 2

Eric Cahuzac