Ingénieur Support Logiciel IA H/F

Twinrise
Caen, France
1 day ago

Role details

Contract type
Temporary contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Languages
English, French

Tech stack

Application Programming Interfaces (APIs) Artificial Intelligence Data Analysis Cloud Computing Databases Continuous Integration Extract Transform Load (ETL) Linux DevOps JSON Python (Programming Language) OpenStack
+14 more
Software Engineering Parquet Pytorch Git Pandas Containerization Gitlab-ci Scikit Learn Kubernetes Information Technology Slurm Machine Learning Operations Restful APIs Docker

Job description

Vous serez affecté(e) au projet TwinRISE et serez rattaché(e) au Groupe Infrastructure Informatique au sein de la Division Soutien Technique et Administratif. Vous devrez collaborer avec des équipes internes et des interlocuteurs externes (INRIA, CNRS/CCIN2P3, GENCI, Hammer HAI et les partenaires du projet : KIT, GSI et CFB).

Le projet TwinRISE : Le GANIL est coordinateur du projet européen TwinRISE - Trusted AI-Generated Digital Twins for Research Infrastructures (Horizon Europe, 2027-2031, 19 partenaires). Le projet développe des jumeaux numériques IA de confiance pour les infrastructures de recherche : surrogates physiques intégrés aux systèmes de contrôle (EPICS), apprentissage fédéré préservant la confidentialité des données, et explicabilité (XAI). Au GANIL, TwinRISE porte sur les jumeaux numériques, l’apprentissage fédéré, la cartographie radiologique et les pipelines de données. Il est en synergie avec iRIS et le réseau de dissémination ARTIFACT.

Contraintes spécifiques :

Le GANIL étant une Installation Nucléaire de Base (INB), une habilitation sera nécessaire pour travailler en zone surveillée et contrôlée dans le respect de la réglementation et des procédures applicables en matière de sécurité et de sûreté nucléaire.

Des déplacements ponctuels sont à prévoir en France et en Europe (CCIN2P3 à Lyon, réunions techniques TwinRISE, conférences).

Envie de mettre vos compétences en informatique et en IA au service de la recherche scientifique ? Rejoignez le GANIL et contribuez au projet européen TwinRISE qui vise à développer des jumeaux numériques IA de confiance pour les infrastructures de recherche.

Votre mission

Vous déploierez, intégrerez et maintiendrez les composants d’infrastructure logicielle et de données nécessaires aux activités IA du projet TwinRISE au GANIL, en interface avec les équipes internes et les partenaires externes.

Vous serez notamment en charge de :

  • Analyser les données opérationnelles de l’accélérateur SPIRAL2 (logbooks, EPICS/TANGO) et concevoir des pipelines ETL pour les structurer selon les principes FAIR et les ontologies.
  • Déployer le Feature Store TwinRISE (Hopsworks) au CCIN2P3, avec des contrôles d’accès et un audit rigoureux.
  • Mettre en place et maintenir des environnements de calcul (CCIN2P3, GENCI, HammerHAI) : workflows Slurm, conteneurisation (Docker/Singularity), et pipelines MLOps (MLflow).
  • Déployer le noeud FedBioMed au GANIL pour l’apprentissage fédéré, avec des mécanismes de sécurité (differential privacy, audit logs signés).
  • Installer et maintenir la machine d’inférence locale GANIL.
  • Intégrer des modèles d’IA via des APIs (REST, MCP) avec les systèmes de contrôle (EPICS/TANGO).
  • Monitorer les modèles en production (détection de drift, métriques) et contribuer aux tests d’acceptance.
  • Rédiger de la documentation technique et apporter sa contribution aux livrables techniques., Pourquoi nous rejoindre ? - Un environnement de travail stimulant et collaboratif au sein d’un laboratoire de recherche scientifique reconnu mondialement dans le domaine de la physique nucléaire - Un cadre de travail agréable situé sur le futur site Epopea, parc de sciences et d’innovation de la communauté urbaine de Caen la Mer - Des avantages collaborateurs : 53 jours de congés par an (32 CA et 21 JRTT) - Télétravail - Participation complémentaire santé - Restaurant d’entreprise - Participation aux frais de transport collectif ou forfait mobilité - Comité Action Sociale - Un accompagnement à la prise de poste et des opportunités de formation - CDD de projet de 4 ansVotre future équipe :Vous serez affecté(e) au projet TwinRISE et serez rattaché(e) au Groupe Infrastructure Informatique au sein de la Division Soutien Technique et Administratif. Vous devrez collaborer avec des équipes internes et des interlocuteurs externes (INRIA, CNRS/CCIN2P3, GENCI, Hammer HAI et les partenaires du projet : KIT, GSI et CFB). Le projet TwinRISE :Le GANIL est coordinateur du projet européen TwinRISE - Trusted AI-Generated Digital Twins for Research Infrastructures (Horizon Europe, 2027-2031, 19 partenaires). Le projet développe des jumeaux numériques IA de confiance pour les infrastructures de recherche : surrogates physiques intégrés aux systèmes de contrôle (EPICS), apprentissage fédéré préservant la confidentialité des données, et explicabilité (XAI). Au GANIL, TwinRISE porte sur les jumeaux numériques, l’apprentissage fédéré, la cartographie radiologique et les pipelines de données. Il est en synergie avec iRIS et le réseau de dissémination ARTIFACT.Contraintes spécifiques : Le GANIL étant une Installation Nucléaire de Base (INB), une habilitation sera nécessaire pour travailler en zone surveillée et contrôlée dans le respect de la réglementation et des procédures applicables en matière de sécurité et de sûreté nucléaire.Des déplacements ponctuels sont à prévoir en France et en Europe (CCIN2P3 à Lyon, réunions techniques TwinRISE, conférences)., Ingénierie logicielle pour l’IA et la donnée scientifique : pipelines de données, MLOps, infrastructures HPC, apprentissage fédéré, déploiement et mise en production de modèles.

  • Python et écosystème data science / ML (PyTorch, scikit-learn, pandas, MLflow, DVC)
  • Pipelines de données (ETL, ingestion), bases de données, formats scientifiques (HDF5, Parquet, JSON-LD, RDF).
  • DevOps/MLOps : Git, CI/CD (GitLab CI), Docker, Kubernetes, Singularity/Apptainer
  • Environnements HPC (Slurm, PBS) et/ou cloud (OpenStack ou équivalent)
  • Standards FAIR, plateformes EOSC (connaissance souhaitable).
  • La connaissance d’architectures d’apprentissage fédéré (FedBioMed, Flower ou équivalents) et de systèmes de contrôle d’accélérateurs (EPICS, TANGO) seraient un plus.
  • Langue anglaise : C1 (cadre européen commun de référence pour les langues)

Vos savoir-faire :

  • Déployer et administrer des services sur infrastructure Linux
  • Mettre en place des pipelines de données et de workflows MLOps en environnement HPC
  • Configurer des noeuds d’apprentissage fédéré avec mécanismes de sécurité et d’audit
  • Intégrer des modèles ML via APIs standardisées dans des systèmes de contrôle
  • Rédiger de la documentation technique en français et en anglais

Requirements

Vous possédez un Bac +5 à Bac +8 en informatique, data science, IA ou dans un domaine connexe.Vos connaissances :- Ingénierie logicielle pour l’IA et la donnée scientifique : pipelines de données, MLOps, infrastructures HPC, apprentissage fédéré, déploiement et mise en production de modèles.- Python et écosystème data science / ML (PyTorch, scikit-learn, pandas, MLflow, DVC)- Pipelines de données (ETL, ingestion), bases de données, formats scientifiques (HDF5, Parquet, JSON-LD, RDF).- DevOps/MLOps : Git, CI/CD (GitLab CI), Docker, Kubernetes, Singularity/Apptainer- Environnements HPC (Slurm, PBS) et/ou cloud (OpenStack ou équivalent)- Standards FAIR, plateformes EOSC (connaissance souhaitable).- La connaissance d’architectures d’apprentissage fédéré (FedBioMed, Flower ou équivalents) et de systèmes de contrôle d’accélérateurs (EPICS, TANGO) seraient un plus.- Langue anglaise : C1 (cadre européen commun de référence pour les langues) Vos savoir-faire :

  • Déployer et administrer des services sur infrastructure Linux- Mettre en place des pipelines de données et de workflows MLOps en environnement HPC- Configurer des noeuds d’apprentissage fédéré avec mécanismes de sécurité et d’audit- Intégrer des modèles ML via APIs standardisées dans des systèmes de contrôle- Rédiger de la documentation technique en français et en anglaisVos savoir-être :- Esprit d’équipe- Capacité à travailler en interface avec des équipes multi-disciplinaires- Autonomie - Rigueur - Proactivité et sens des priorité- AdaptabilitéPrêt(e) à relever le défi ? Si cette opportunité vous inspire, postulez dès maintenant et rejoignez une équipe engagée au service de la recherche scientifique !, Vous possédez un Bac +5 à Bac +8 en informatique, data science, IA ou dans un domaine connexe., Esprit d’équipe
  • Capacité à travailler en interface avec des équipes multi-disciplinaires
  • Autonomie
  • Rigueur
  • Proactivité et sens des priorité
  • Adaptabilité

Prêt(e) à relever le défi ?, Anglais ETL Intelligence artificielle API REST Git Création d’une base documentaire Pro-activité Kubernetes RDF Python Autonomie JSON Docker

About the company

Un environnement de travail stimulant et collaboratif au sein d’un laboratoire de recherche scientifique reconnu mondialement dans le domaine de la physique nucléaire

  • Un cadre de travail agréable situé sur le futur site Epopea, parc de sciences et d’innovation de la communauté urbaine de Caen la Mer
  • Des avantages collaborateurs : 53 jours de congés par an (32 CA et 21 JRTT) - Télétravail - Participation complémentaire santé - Restaurant d’entreprise - Participation aux frais de transport collectif ou forfait mobilité - Comité Action Sociale
  • Un accompagnement à la prise de poste et des opportunités de formation
  • CDD de projet de 4 ans

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:14 min

Exploring internal AI product initiatives and global engineering roles

Maria Apazoglou · Coffee With Developers

2:22 min

Infrastructure barriers and compliance risks in research

Jeremy Murray Jeremy Murray · World Congress 2026 Europe

3:47 min

Exploring JSON, CBOR, and JOSE for data serialization

Aaron Russell · LIVE

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

1:51 min

Managing GPU quotas and multi-tenancy with Kueue

Jeremy Murray Jeremy Murray · World Congress 2026 Europe

2:03 min

Distinguishing type definition constructs from data validation routines

Clemens Vasters Clemens Vasters · World Congress 2025

Videos

See all

Related articles

See all