Scientist Tabular Foundation Models Paris ou Remote 80K-100K + Bspce H/F

Monetaryamount
Paris, France
23 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Part-time (≤ 32 hours)
Compensation
€80,000.0 - €100,000.0
Working hours
Regular working hours
Languages
English

Tech stack

Software Debugging Python (Programming Language) NoSQL Open Source Technology SQL Databases Parquet Pytorch Large Language Models Deep Learning Git Information Technology Slurm

Job description

Startup IA d’une dizaine de personnes, travaillant sur une nouvelle génération de modèles IA dédiés aux données structurées (tabulaires). Un positionnement scientifique rare : accès à la data et au compute, deux ressources critiques en recherche que peu de startups peuvent offrir. Partenaires industriels et académiques de premier plan. Ce que ce poste n’est pas Pas un poste de finetuning ou d’évaluation sur des modèles déjà entraînés. Pas un profil NLP orienté linguistique. Vous concevez et entraînez des architectures from scratch, avec une vraie orientation recherche fondamentale., Développement de modèles ML de représentation pour données structurées (embedding models)

  • Conception, entraînement et évaluation de Tabular Foundation Models from scratch
  • Active learning et optimisation des données d’entraînement
  • Évaluation continue des performances via des métriques adaptées aux cas clients
  • Veille sur les dernières avancées ML et proposition d’optimisations
  • Communication scientifique : présentation à la communauté et aux équipes internes
  • Analyses ad-hoc sur les mécanismes d’apprentissage des modèles

Requirements

Profil recherchéProfil recherchéPhD en ML, Computer Science ou domaine proche, focus deep learning3+ ans d’expérience en entraînement de modèles, conception d’architectures et préentraînement from scratchPublications dans des conférences top-tier ML en lien direct avec les sujets visés (indispensable)Maîtrise PyTorch, SLURM, Deepspeed (ou équivalent)Bonne pratique Python, Git, gestion de larges datasets (Parquet, SQL/NoSQL)Anglais courantProfils hors France acceptés en full remote pour les meilleurs dossiersBonus appréciésExpérience en large-scale ML experimentsActivité open-source ou compétitions data scienceExpérience C/C++PackageJusqu’à 100K selon profilBSPCEMutuelle + tickets restoProcessFit Interview (30 min) Research Fit avec VP Recherche (45 min) Debugging/Code test (30 min) Technical Interview avec restitution (1h30) Onsite avec les fondateurs Ref Calls, * PhD en ML, Computer Science ou domaine proche, focus deep learning

  • 3+ ans d’expérience en entraînement de modèles, conception d’architectures et préentraînement from scratch
  • Publications dans des conférences top-tier ML en lien direct avec les sujets visés (indispensable)
  • Maîtrise PyTorch, SLURM, Deepspeed (ou équivalent)
  • Bonne pratique Python, Git, gestion de larges datasets (Parquet, SQL/NoSQL)
  • Anglais courant
  • Profils hors France acceptés en full remote pour les meilleurs dossiers

Bonus appréciés

  • Expérience en large-scale ML experiments
  • Activité open-source ou compétitions data science, Anglais SQL Git Python NoSQL

Benefits & conditions

  • Expérience C/C++

Package

  • Jusqu’à 100K selon profil
  • BSPCE
  • Mutuelle + tickets resto

Process Fit Interview (30 min) Research Fit avec VP Recherche (45 min) Debugging/Code test (30 min) Technical Interview avec restitution (1h30) Onsite avec les fondateurs Ref Calls, Scientist Tabular Foundation Models Paris ou Remote 80K-100K + Bspce H/F

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

3:52 min

Comparing French work-life balance principles with international engineering practices

Chris Heilmann +2 · LIVE

2:22 min

Infrastructure barriers and compliance risks in research

Jeremy Murray Jeremy Murray · World Congress 2026 Europe

2:37 min

Comparing traditional SQL tables versus NoSQL non-tabular databases

Stanimira Vlaeva · JS Congress

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

1:51 min

Managing GPU quotas and multi-tenancy with Kueue

Jeremy Murray Jeremy Murray · World Congress 2026 Europe

3:16 min

Terminology differences between relational and NoSQL databases

Tim Faulkes · LIVE

Videos

See all

Related articles

See all