Opportunité Rennes ! Data Scientist Python / NLP H/F

ADONYS
Rennes, France
28 days ago
Apply on fr.indeed.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Experienced
Experience required
2 years minimum
Working hours
Regular working hours
Job source

Tech stack

Artificial Intelligence Microsoft Azure Code Review Continuous Integration Python (Programming Language) PostgreSQL MongoDB Natural Language Processing Parsing Azure Machine Learning Retrieval-Augmented Generation Large Language Models
+4 more
Generative AI Kubernetes Machine Learning Operations Docker

Job description

ContexteDans le cadre du développement de solutions d’Intelligence Artificielle appliquées au traitement documentaire, nous recherchons un Data Scientist spécialisé en NLP pour renforcer une équipe Data & IA.

Le consultant interviendra sur des problématiques d’analyse et d’extraction d’informations à partir de documents contractuels (contrats clients, fournisseurs, NDA, conventions, marchés publics, avenants, etc.) afin d’automatiser leur traitement et leur exploitation.

L’environnement est fortement orienté vers les technologies de traitement du langage naturel (NLP), l’IA générative et les modèles de langage (LLM).

MissionsAnalyse documentaireComprendre la structure et les spécificités des documents contractuels.

Identifier les informations métier à extraire (parties prenantes, dates, montants, échéances, clauses, pénalités, obligations, renouvellements, etc.).

Participer à la définition des modèles de données cibles.

Développement NLPConcevoir et développer des pipelines de traitement documentaire.

Mettre en ?uvre des modèles de : Classification de documents

Extraction d’entités nommées (NER)

Extraction de clauses contractuelles, Fine-tuner des modèles NLP adaptés aux besoins métier.

Évaluer et améliorer les performances des modèles.

IA GénérativeConcevoir des solutions basées sur les LLM.

Développer des architectures RAG (Retrieval Augmented Generation).

Optimiser les prompts et les chaînes de traitement.

Évaluer les performances et limiter les hallucinations.

IndustrialisationDévelopper des services Python robustes et maintenables.

Participer aux revues de code.

Mettre en place des tests et métriques de qualité.

Contribuer à l’industrialisation des modèles en environnement cloud.

CollaborationTravailler en étroite collaboration avec : Product Owner, IA GénérativeOpenAI / Azure OpenAI

LangChain

LlamaIndex

RAG

Embeddings, Vector Search

Traitement documentaireOCR

Azure Document Intelligence

Tesseract

Extraction PDF

Parsing documentaire

Bases de donnéesSQL

PostgreSQL

MongoDB (apprécié)

MLOps & CloudGit

Docker

Requirements

Kubernetes (apprécié)

Azure

Azure Machine Learning

Azure AI Foundry, Minimum4 ans d’expérience en Data Science.

2 ans minimum sur des projets NLP.

IdéalementExpérience sur des projets de traitement documentaire.

Expérience dans les domaines : Juridique

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on fr.indeed.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:07 min

Inspecting default bridge architectures and custom Docker networks

Oliver Seitz Oliver Seitz · World Congress 2025

2:01 min

Migrating existing applications from MongoDB to Postgres

Nikita Shamgunov Nikita Shamgunov · World Congress 2024

2:56 min

Open-sourcing a complex parsing library for game data

Johan Hutting Johan Hutting · World Congress 2024

3:13 min

Addressing language barriers and the data science talent deficit

Markus Hacker Markus Hacker +3 · World Congress 2024

2:34 min

Docker sandbox architecture and microVM environment integration

Manuel de la Peña Manuel de la Peña · World Congress 2026 Europe

2:37 min

Optimizing technical profiles for AI sourcing and recruitment

Mina Golesorkhi Mina Golesorkhi · World Congress 2026 Europe

Videos

See all

Related articles

See all