Opportunité Rennes ! Data Scientist Python / NLP H/F
Role details
Job location
Tech stack
Job description
ContexteDans le cadre du développement de solutions d'Intelligence Artificielle appliquées au traitement documentaire, nous recherchons un Data Scientist spécialisé en NLP pour renforcer une équipe Data & IA.
Le consultant interviendra sur des problématiques d'analyse et d'extraction d'informations à partir de documents contractuels (contrats clients, fournisseurs, NDA, conventions, marchés publics, avenants, etc.) afin d'automatiser leur traitement et leur exploitation.
L'environnement est fortement orienté vers les technologies de traitement du langage naturel (NLP), l'IA générative et les modèles de langage (LLM).
MissionsAnalyse documentaireComprendre la structure et les spécificités des documents contractuels.
Identifier les informations métier à extraire (parties prenantes, dates, montants, échéances, clauses, pénalités, obligations, renouvellements, etc.).
Participer à la définition des modèles de données cibles.
Développement NLPConcevoir et développer des pipelines de traitement documentaire.
Mettre en ?uvre des modèles de : Classification de documents
Extraction d'entités nommées (NER)
Extraction de clauses contractuelles, Fine-tuner des modèles NLP adaptés aux besoins métier.
Évaluer et améliorer les performances des modèles.
IA GénérativeConcevoir des solutions basées sur les LLM.
Développer des architectures RAG (Retrieval Augmented Generation).
Optimiser les prompts et les chaînes de traitement.
Évaluer les performances et limiter les hallucinations.
IndustrialisationDévelopper des services Python robustes et maintenables.
Participer aux revues de code.
Mettre en place des tests et métriques de qualité.
Contribuer à l'industrialisation des modèles en environnement cloud.
CollaborationTravailler en étroite collaboration avec : Product Owner, IA GénérativeOpenAI / Azure OpenAI
LangChain
LlamaIndex
RAG
Embeddings, Vector Search
Traitement documentaireOCR
Azure Document Intelligence
Tesseract
Extraction PDF
Parsing documentaire
Bases de donnéesSQL
PostgreSQL
MongoDB (apprécié)
MLOps & CloudGit
Docker
Requirements
Kubernetes (apprécié)
Azure
Azure Machine Learning
Azure AI Foundry, Minimum4 ans d'expérience en Data Science.
2 ans minimum sur des projets NLP.
IdéalementExpérience sur des projets de traitement documentaire.
Expérience dans les domaines : Juridique