Scientist Tabular Foundation Models Paris ou Remote 80K-100K + Bspce H/F
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
Job description
Startup IA d’une dizaine de personnes, travaillant sur une nouvelle génération de modèles IA dédiés aux données structurées (tabulaires). Un positionnement scientifique rare : accès à la data et au compute, deux ressources critiques en recherche que peu de startups peuvent offrir. Partenaires industriels et académiques de premier plan. Ce que ce poste n’est pas Pas un poste de finetuning ou d’évaluation sur des modèles déjà entraînés. Pas un profil NLP orienté linguistique. Vous concevez et entraînez des architectures from scratch, avec une vraie orientation recherche fondamentale., Développement de modèles ML de représentation pour données structurées (embedding models)
- Conception, entraînement et évaluation de Tabular Foundation Models from scratch
- Active learning et optimisation des données d’entraînement
- Évaluation continue des performances via des métriques adaptées aux cas clients
- Veille sur les dernières avancées ML et proposition d’optimisations
- Communication scientifique : présentation à la communauté et aux équipes internes
- Analyses ad-hoc sur les mécanismes d’apprentissage des modèles
Requirements
Profil recherchéProfil recherchéPhD en ML, Computer Science ou domaine proche, focus deep learning3+ ans d’expérience en entraînement de modèles, conception d’architectures et préentraînement from scratchPublications dans des conférences top-tier ML en lien direct avec les sujets visés (indispensable)Maîtrise PyTorch, SLURM, Deepspeed (ou équivalent)Bonne pratique Python, Git, gestion de larges datasets (Parquet, SQL/NoSQL)Anglais courantProfils hors France acceptés en full remote pour les meilleurs dossiersBonus appréciésExpérience en large-scale ML experimentsActivité open-source ou compétitions data scienceExpérience C/C++PackageJusqu’à 100K selon profilBSPCEMutuelle + tickets restoProcessFit Interview (30 min) Research Fit avec VP Recherche (45 min) Debugging/Code test (30 min) Technical Interview avec restitution (1h30) Onsite avec les fondateurs Ref Calls, * PhD en ML, Computer Science ou domaine proche, focus deep learning
- 3+ ans d’expérience en entraînement de modèles, conception d’architectures et préentraînement from scratch
- Publications dans des conférences top-tier ML en lien direct avec les sujets visés (indispensable)
- Maîtrise PyTorch, SLURM, Deepspeed (ou équivalent)
- Bonne pratique Python, Git, gestion de larges datasets (Parquet, SQL/NoSQL)
- Anglais courant
- Profils hors France acceptés en full remote pour les meilleurs dossiers
Bonus appréciés
- Expérience en large-scale ML experiments
- Activité open-source ou compétitions data science, Anglais SQL Git Python NoSQL
Benefits & conditions
- Expérience C/C++
Package
- Jusqu’à 100K selon profil
- BSPCE
- Mutuelle + tickets resto
Process Fit Interview (30 min) Research Fit avec VP Recherche (45 min) Debugging/Code test (30 min) Technical Interview avec restitution (1h30) Onsite avec les fondateurs Ref Calls, Scientist Tabular Foundation Models Paris ou Remote 80K-100K + Bspce H/F
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Talks and stories from around this role — technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
Best Companies to Work For in France: Top 25 Companies in 2023
Software Engineer Salary London
Fully Remote Software Engineer Jobs
Data Engineer Salary UK