> Markdown version of [/jobs/ext/434761-data-scientist-h-f](https://www.wearedevelopers.com/jobs/ext/434761-data-scientist-h-f). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Data Scientist H/F - **Company:** Caisse des Dépôts - **Location:** Paris, France - **Experience:** Starter - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, Microsoft Azure, Big Data, Continuous Integration, Apache Hadoop, Apache Hive, Python (Programming Language), Machine Learning, MongoDB, NoSQL, Open Source Technology, Azure Machine Learning, SQL Databases, Unstructured Data, Data Processing, Large Language Models, Apache Spark, Deep Learning, Generative AI, Pyspark, Data Management, Machine Learning Operations, Dataiku - **Published:** June 24, 2026 - **Apply:** https://www.hellowork.com/fr-fr/emplois/80531307.html ## About the Role Diplôme et spécialité éventuelle:Titulaire d'un doctorat en IA ou d'un diplôme d'une grande école d'ingénieur ou d'un troisième cycle universitaire spécialisé en data science, intelligence artificielle, mathématiques appliquées ou enstatistiques avec au moins une première expérience réussie en data science· Maîtrise des langages de programmation Python, SQL et PySpark· Maîtrise technique et théorique en Machine learning Deep learning· Connaissances techniques spécifiques de textmining, speechtotext, OCR· Expérience en IA Générative, connaissances techniques spécifiques des modèles LLM· Connaissances des outils informatiques de gestion des données (SQL et NoSQL) et des architectures Big Data (Hadoop, Spark, Hive, Mongo DB, Pig ...), des logiciels et plateforme data et IA de place (Dataiku,..).· Connaissances en MLOps et industrialisation de modèlesQualités personnelles· Fort engagement et capacité à travailler au sein d'une équipe de façon autonome ;· Capacité à s'adapter à une grande variété d'enjeux, de situations et d'interlocuteurs ;· Capacité à traiter plusieurs sujets en parallèle dans un mode gestion de projet ;· Respecter la confidentialité des informations fournies ;· Capacité à collaborer avec des équipes SI, sécurité, et métier· Excellent niveau de communication et de vulgarisation technique· Esprit d'initiative, force de conviction et de proposition ;· Grand respect des délais et des priorités, Diplôme et spécialité éventuelle: Titulaire d'un doctorat en IA ou d'un diplôme d'une grande école d'ingénieur ou d'un troisième cycle universitaire spécialisé en data science, intelligence artificielle, mathématiques appliquées ou en statistiques avec au moins une première expérience réussie en data science · Maîtrise des langages de programmation Python, SQL et PySpark · Maîtrise technique et théorique en Machine learning Deep learning · Connaissances techniques spécifiques de textmining, speechtotext, OCR · Expérience en IA Générative, connaissances techniques spécifiques des modèles LLM · Connaissances des outils informatiques de gestion des données (SQL et NoSQL) et des architectures Big Data (Hadoop, Spark, Hive, Mongo DB, Pig ...), des logiciels et plateforme data et IA de place (Dataiku,..). · Connaissances en MLOps et industrialisation de modèles Qualités personnelles · Fort engagement et capacité à travailler au sein d'une équipe de façon autonome ; · Capacité à s'adapter à une grande variété d'enjeux, de situations et d'interlocuteurs ; · Capacité à traiter plusieurs sujets en parallèle dans un mode gestion de projet ; · Respecter la confidentialité des informations fournies ; · Capacité à collaborer avec des équipes SI, sécurité, et métier · Excellent niveau de communication et de vulgarisation technique · Esprit d'initiative, force de conviction et de proposition ; · Grand respect des délais et des priorités EUR Machine learning Intelligence artificielle Hadoop SQL Gestion des données Hive Pro-activité Force de persuasion Big data Python Conduite de projet NoSQL ## Description Vous participerez et impulserez la Transformation de la Direction des politiques sociales par l'usage de nouvelles technologies et de l'intelligence artificielle apportant des innovations à nos services, incrémentales ou disruptives, faisant évoluer les façons de faire des collaborateurs, et in fine le service rendu à nos clients. Plus spécifiquement, vous valoriserez et amplifierez l'usage de l'ensemble des leviers numériques, Data & IA pour répondre aux enjeux de la Direction des Politiques sociales (DPS). Vous serez rattaché(e) au Service Numérique DATA et IA de la Direction de l'innovation et de la prospective, et réaliserez vos missions sous la supervision du Lead data scientist de la DPS, lui-même rattaché au Responsable du Service. Vous participerez activement à la mise en oeuvre des cas d'usage IA priorisés dans la feuille de route IA de la DPS. Vous travaillerez notamment sur plusieurs projets internes d'IA Générative sous la supervision du lead data scientist de l'équipe pour répondre aux cas d'usage des métiers de la DPS. Vos missions pourront être les suivantes Définir et implémenter le preprocessing des données non structurées (textes, catalogue de formations, référentiel de compétences et métiers) pour modéliser leur extraction et retraitement algorithmique dans la plateforme data Optimiser tous les traitements en termes de performance machine et de performance (métrique) statistique Sélection, intégration et optimisation de modèles LLM open source Conception et mise en oeuvre de solutions basées sur RAG (Retrieval- Augmented Generation) Développement d'agents autonomes (boucles perception/action, agents multitâches) Déploiement via DataikuUtilisation des services IA de Microsoft Azure (OpenAI, Azure ML, Copilot Studio) Industrialisation : CI/CD, monitoring, documentation, MLOps Sélectionner et documenter les techniques adéquates et construire les solutions nécessaires au traitement des données non structurées afin de répondre aux besoins soulevés Définir une stratégie qui permette de trouver les meilleurs modèles et de répondre à la problématique métier adressée Présenter de façon pédagogique les approches proposées et documenter les résultats à travers une documentation technique et un mode opératoire ## Related Videos - [Data Science in Retail](https://www.wearedevelopers.com/videos/586-data-science-in-retail) - [40 Minutes to Build a Serverless COVID-19 REST and GraphQL APIs](https://www.wearedevelopers.com/videos/208-40-minutes-to-build-a-serverless-covid-19-rest-and-graphql-apis) - [PySpark - Combining Machine Learning & Big Data](https://www.wearedevelopers.com/videos/44-pyspark-combining-machine-learning-big-data) - [Leveraging Real time data in FSIs](https://www.wearedevelopers.com/videos/806-leveraging-real-time-data-in-fsis) - [NoSQL Data Modeling for Front-end Developers](https://www.wearedevelopers.com/videos/297-nosql-data-modeling-for-front-end-developers) - [Empowering Retail Through Applied Machine Learning](https://www.wearedevelopers.com/videos/976-empowering-retail-through-applied-machine-learning) ## Related Articles - [Best Companies to Work For in Paris: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/190-best-companies-to-work-for-in-paris-top-25-companies-in-2023) - [Data Analyst Salary in the UK](https://www.wearedevelopers.com/magazine/278-data-analyst-salary-in-the-uk) - [Best Companies to Work For in France: Top 25 Companies in 2023 ](https://www.wearedevelopers.com/magazine/189-best-companies-to-work-for-in-france-top-25-companies-in-2023) - [Data Engineer Salary UK](https://www.wearedevelopers.com/magazine/253-data-engineer-salary-uk) - [Coffee with Developers - Maria Apazoglou - Making AI understandable for all in production](https://www.wearedevelopers.com/magazine/475-coffee-with-developers-maria-apazoglou-making-ai-understandable-for-all-in-production) - [How to Become an AI Engineer](https://www.wearedevelopers.com/magazine/331-how-to-become-an-ai-engineer)