Menu

Offres d'emploi › Auvergne-Rhône-Alpes

Ingénieur/Ingénieure d'étude bases de données et pipelines de traitement des corpus textuels médiévaux -

Ecole Normale Supérieure LyonPubliée il y a 4 jours
AutreEmploi public
Entreprise
Ecole Normale Supérieure Lyon — Rhône (69)
Lieu
69
Contrat
Catégorie A — Emploi ouvert uniquement aux contractuels
Expérience
Non renseigné
Secteur
Recherche
Postuler sur le site de l'offre →

Description du poste

MISSIONS :
Dans le cadre du projet ANR Phil•IA, l'ingénieur.e assurera le développement et la maintenance de l'infrastructure numérique du projet :
Base de données hagiographique (WP1)
Développement d'une base de données open source dédiée à l'exploration de corpus hagiographiques
Modélisation garantissant l'interopérabilité avec les bases existantes (Jonas, Biblissima+)
Intégration des données textuelles et codicologiques dans la base
Chaîne d'acquisition et de traitement des textes (WP2)

Déploiement d'une chaîne de traitement allant de la reconnaissance automatique de texte (ATR) à partir de modèles existants (CATMuS-Medieval) jusqu’à l’encodage XML TEI
Mise en œuvre de l'annotation linguistique (lemmatisation, étiquetage morphosyntaxique)
Encodage TEI des transcriptions et intégrations dans la base de données
Schéma TEI d'édition stratifiée (WP3)
Implémentation du schéma TEI supportant l'édition stratifiée (transcription diplomatique, semi-normalisée, annotée, texte critique)
Interconnexion des couches textuelles avec la base de données
Transversal
Publication en accès ouvert des données, scripts et jeux d'entraînement sur des dépôts ouverts (Nakala, Zenodo, GitLab)
Contribution à la documentation technique et à la pérennité des outils développés

Profil recherché :
COMPETENCES REQUISES :
Compétences techniques requises
Maîtrise des principes de modélisation et de développement de bases de données (interopérabilité, standards ouverts)
Compétences en développement de scripts et pipelines de traitement de données, maîtrise de Python demandée
Pratique de l'encodage XML TEI et du langage de transformation XSLT
Pratique de Git, GitHub et/ou GitLab
Compétences techniques appréciées
Connaissance des principes de la reconnaissance automatique d'écriture (eScriptorium, Kraken, modèles CATMuS)
Connaissance des outils de traitement automatique du langage pour l'annotation linguistique (lemmatisation, étiquetage morphosyntaxique)
Connaissance d'eXist-db/XQuery (environnement TEI Publisher)
Connaissance souhaitée des corpus médiévaux ou des problématiques de philologie numérique
Compétences linguistiques

Niveau de français B2 ou C1 minimum
Niveau d’anglais B2
Compétences relationnelles
Autonomie, rigueur et capacité à travailler en équipe

L'employeur :
L'École normale supérieure de Lyon produit une recherche de haut niveau dans ses 25 laboratoires et forme par la recherche quelque 2500 étudiants dont 500 doctorants. Elle compte environ 550 enseignants, enseignants-chercheurs et chercheurs et 600 personnels administratifs et techniques.
Dans le classement de Shanghai et QS, elle apparaît parmi les tous premiers établissements français en termes de performance per capita.
Son objectif est d'avoir un impact significatif en matière de recherche, d'innovation et de transfert de technologie tout en irriguant la fonction publique et le monde socio-économique de diplômés rompus à la complexité, capables de produire et transmettre des savoirs.

L'ENS de Lyon met ses ressources au service d'une vision ouverte de la société et des enjeux contemporains qu'elle veut éclairer.
Son budget annuel est d’environ 160 M €.
L'ENS de Lyon est une école dynamique, où la qualité de vie au travail, le développement durable et l’égalité professionnelle représentent des dimensions centrales.
Descriptif du service
CONTEXTE :
L’ingénieur.e sera recruté.e dans la cadre du projet Phil•IA (ANR JCJC, 42 mois) qui développe une approche méthodologique innovante pour l'étude des textes hagiographiques français des XIIIe-XVe siècles dans leur contexte manuscrit, en croisant philologie et humanités numériques. Le contrat proposé à l'ingénieur/ingénieure d'étude est un contrat de deux ans.
Le projet articule trois volets : constitution et interconnexion d'une base de données hagiographique, acquisition et édition des textes (ATR, normalisation, encodage TEI), analyse et valorisation des données (publication en ligne des données, édition des textes, stylométrie, alignement des versions, etc.).
L'ingénieur.e rejoint une équipe resserrée composée de la coordinatrice et d'un.e doctorant.e (recruté.e en septembre 2027), et travaille en lien avec des partenaires extérieurs (Inria/ALMAnaCH pour la normalisation des textes médiévaux, consortium Biblissima+ pour l’enrichissement du portail textes).
Le poste s'inscrit au CIHAM (UMR 5648), au sein de l'axe Humanités Numériques (Sources, Corpus, données : Modélisations numériques). L'ingénieur.e bénéficiera des infrastructures Huma-Num (Nakala, Oxygen XML, TEI Publisher, Heurist) et d'eScriptorium, ainsi que d'un environnement de recherche national via les partenaires du projet (Inria, consortium Biblissima+). L’ingénieur.e sera accueilli dans les bureaux de l’ENS de Lyon.
La personne recrutée sera encadrée par Ariane Pinche (CNRS, CIHAM).

Source : Choisir le service public. Publiée le 2 octobre 2026.

Offres similaires en Auvergne-Rhône-Alpes

Autre

Annecyil y a 1 min

Autre

Bourg-lès-Valenceil y a 1 min

Autre

Firminyil y a 1 min

Autre

Albertvilleil y a 1 min