> Markdown version of [/jobs/ext/2337152-data-scientist-nlp-ia-en-sante-h-f](https://www.wearedevelopers.com/jobs/ext/2337152-data-scientist-nlp-ia-en-sante-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data scientist - nlp & ia en santé H/F - **Company:** Hopital Foch - **Location:** Suresnes, France - **Experience:** Experienced - **Contract:** Permanent contract - **Skills:** Code Review, Information Systems, Databases, Continuous Integration, Data Warehousing, Linux, Distributed Systems, Python (Programming Language), Machine Learning, Microsoft Visio, Raw Data, SQL Databases, Pytorch, Large Language Models, Deep Learning, Git, HuggingFace, Data Management - **Published:** August 27, 2026 - **Apply:** https://fr.indeed.com/viewjob?jk=6c5ab6ec627fdf41 ## About the Role Formation et expérience * Diplôme d'ingénieur ou équivalent (Bac+5, Master 2) en data science * 3 ans d'expérience démontrant une maîtrise de Python et des bonnes pratiques de revue de code et d'intégration continue, Vous avez un savoir-faire dans plusieurs de ces domaines : * Expertise en traitement automatique des langues (NLP), utilisation et entraînement de modèles de langue (LLM) * Expertise en statistiques * Expertise en analyse de bases de données (SQL) * Expertise en développement de modèles de machine learning (Huggingface, PyTorch, etc.) * Expertise en calcul distribué et data management * Expertise en développement Python * Expertise en déploiement de modèles statistiques/machine learning * Maîtrise de Linux et Git * Anglais courant (interactions avec des partenaires internationaux) Qualités humaines * Autonomie, flexibilité et sens des responsabilités * Curiosité, dynamisme et créativité, avec une réelle envie d'innover * Esprit d'équipe et volonté de prendre part à une aventure collective * Capacité de vulgarisation des enjeux techniques à un public non-spécialiste * Sens de l'écoute, du résultat et de la qualité Processus de recrutement * QCM en ligne éliminatoire (15 minutes) * Entretien avec des membres de l'Unité Data (visio), incluant une revue du parcours professionnel du candidat et une évaluation technique en Python et Machine Learning, sans assistance d'IA pour le code, sur un notebook Collab de 30 minutes. Durée estimée : 2 heures maximum ## Description * Aide au diagnostic en imagerie médicale (radiologie, médecine nucléaire) * Transcription automatique des comptes rendus médicaux (DAX Copilot) * Optimisation des plannings et de l'organisation des soins * Enrichissement des cohortes d'essais cliniques par données augmentées * Projets multicentriques de recherche (LUCC en oncologie, CUB en pneumologie) * Organisation de Data Challenges internationaux (DigiLut sur la greffe pulmonaire) L'équipe Data Science L'équipe Data Science a pour mission de faciliter l'analyse de l'Entrepôt de Données de Santé, qui contient les données médicales de plusieurs millions de patients. Elle développe des bibliothèques scientifiques et des algorithmes permettant de transformer les données brutes en informations exploitables par les chercheurs et les cliniciens. L'équipe travaille en étroite collaboration avec les services cliniques et de nombreux partenaires académiques et industriels sur des cas d'usage divers., Au sein de l'équipe Data Science, vous aurez pour mission de développer, valider et maintenir des algorithmes et bibliothèques logicielles facilitant l'exploitation des données issues du système d'information clinique à des fins de recherche et de pilotage. Vous vous concentrerez en particulier sur le traitement automatique du langage permettant de transformer les données textuelles de l'EDS en données structurées directement exploitables. Vous serez également impliqué dans le développement et l'adaptation de modèles de langage (LLM) pour des cas d'usage cliniques concrets. Les développements que vous réaliserez seront diffusés au sein de la communauté de recherche et vous serez amené(e) à contribuer à des articles scientifiques valorisant ces travaux d'un point de vue académique., Au sein de l'équipe Data Science, vous aurez pour mission de développer, valider et maintenir des algorithmes et bibliothèques logicielles facilitant l'exploitation des données issues du système d'information clinique à des fins de recherche et de pilotage. Vous vous concentrerez en particulier sur le traitement automatique du langage permettant de transformer les données textuelles de l'EDS en données structurées directement exploitables. Vous serez également impliqué dans le développement et l'adaptation de modèles de langage (LLM) pour des cas d'usage cliniques concrets. Les développements que vous réaliserez seront diffusés au sein de la communauté de recherche et vous serez amené(e) à contribuer à des articles scientifiques valorisant ces travaux d'un point de vue académique. Missions principales * Consolidation de l'expression de besoin « traitement automatique du langage » avec les équipes de recherche et de pilotage de l'EDS * Développement, validation et maintenance de bibliothèques logicielles scientifiques écrites en Python * Développement et déploiement de modèles de machine learning et deep learning pour le pré-traitement des données * Implication dans le développement de LLM médicaux et leur adaptation à des cas d'usage cliniques * Rédaction de la documentation technique et utilisateur * Développement de partenariats académiques * Contribution à l'écriture d'articles scientifiques Missions ponctuelles * Support utilisateur et formation au traitement automatique du langage * Conseil interne et accompagnement des projets de recherche * Promotion des outils et des pratiques de l'équipe Data Science aux équipes cliniques * Participation aux Data Challenges et initiatives d'innovation ## Related Videos - [Shipping Faster with Less: Render on Cloud Hosting, AI Workloads, and the Future of DevOps](https://www.wearedevelopers.com/videos/1894-shipping-faster-with-less-render-on-cloud-hosting-ai-workloads-and-the-future-of-devops) - [How a Small Team Shrank a Microsoft Monorepo by 94%](https://www.wearedevelopers.com/videos/1236-how-a-small-team-shrank-a-microsoft-monorepo-by-94) - [Docker network without Docker](https://www.wearedevelopers.com/videos/1418-docker-network-without-docker) - [Photonic Computing: Programming a New Class of AI Accelerators (incl. Live Coding)](https://www.wearedevelopers.com/videos/100196-photonic-computing-programming-a-new-class-of-ai-accelerators-incl-live-coding) - [Geometric deep learning for drug discovery](https://www.wearedevelopers.com/videos/264-geometric-deep-learning-for-drug-discovery) - [Recruitment Reinvented: Bold strategies and the $10K signing incentive](https://www.wearedevelopers.com/videos/1068-recruitment-reinvented-bold-strategies-and-the-10k-signing-incentive) ## Related Articles - [Best Companies to Work For in Paris: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/190-best-companies-to-work-for-in-paris-top-25-companies-in-2023) - [Best Companies to Work For in France: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/189-best-companies-to-work-for-in-france-top-25-companies-in-2023) - [Top 6 Hackathons for Developers in 2023](https://www.wearedevelopers.com/magazine/263-top-6-hackathons-for-developers-in-2023) - [Best Coding Boot Camps in Germany](https://www.wearedevelopers.com/magazine/237-best-coding-boot-camps-in-germany) - [Data Engineer Salary UK](https://www.wearedevelopers.com/magazine/253-data-engineer-salary-uk) - [The Most Popular IT Jobs on the Market](https://www.wearedevelopers.com/magazine/376-the-most-popular-it-jobs-on-the-market)