> Markdown version of [/jobs/ext/1961886-ai-runtime-low-level-software-engineer](https://www.wearedevelopers.com/jobs/ext/1961886-ai-runtime-low-level-software-engineer). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # AI Runtime / Low-Level Software Engineer - **Company:** Kalray - **Location:** Montbonnot-Saint-Martin, France (Remote available) - **Experience:** Expert - **Contract:** Permanent contract - **Skills:** Application Programming Interfaces (APIs), Artificial Intelligence, Automation of Tests, Compilers, Profiling, Software Quality, Computer Engineering, Continuous Integration, Linux, Embedded Software, Emulators, Firmware, Open Source Technology, PCI Express, Performance Tuning, Quick EMUlator (QEMU), Software Engineering, Data Streaming, System Software, Delivery Pipeline, Large Language Models, Parallel Computation, Generative AI, Information Technology - **Published:** August 7, 2026 - **Apply:** https://nostalentsnosemplois.auvergnerhonealpes.fr/candidat/offres/offre-d-emploi-ingenieur-de-developpement-logiciel-h-f-montbonnot-saint-martin-auvergne-rhone-alpes-industrie-production-autres-cdi-16225739 ## About the Role Excellente maîtrise du développement système en C et/ou C++ sous Linux, sur des bases de code complexes. - Solide expérience de la programmation parallèle et concurrente : gestion des threads, transferts mémoire, profiling et optimisation des performances. - Expérience du développement de logiciels embarqués, de firmware ou de logiciels bare metal, idéalement avec des technologies telles que OpenAMP, remoteproc, rpmsg, virtio ou des modèles de communication basés sur la mémoire partagée. - Bonne connaissance du fonctionnement interne de Linux, notamment des mécanismes mmap, sysfs, du modèle de périphériques Linux ainsi que des fondamentaux de PCIe (BAR, DMA). - Expérience des architectures RISC-V (ou ISA équivalentes), de la cross-compilation et du débogage bas niveau à l'interface matériel/logiciel. Atouts appréciés - Expérience de l'écosystème d'inférence IA générative (GenAI/LLM) avec des frameworks tels que vLLM, ou des technologies de compilation IA telles que MLIR et LLVM. - Expérience du développement de pilotes Linux (PCIe, remoteproc) ainsi que des environnements d'émulation tels que QEMU. - Expérience des environnements CI/CD appliqués à des plateformes matérielles ou d'émulation. - Expérience du développement de chemins de données à haute performance, incluant les mécanismes DMA et les techniques zero-copy., Diplôme d'ingénieur ou Master 2 (Bac+5) en informatique, systèmes embarqués, génie informatique ou domaine équivalent. - Au moins 5 ans d'expérience dans le développement de logiciels bas niveau, de systèmes embarqués, de runtimes ou de logiciels système. - Forte autonomie et sens des responsabilités, avec la capacité de piloter un composant logiciel complexe de la conception jusqu'à sa mise en production et de prendre des décisions techniques structurantes. - Vision globale des systèmes, permettant de comprendre l'ensemble de la chaîne logicielle, depuis les couches d'inférence IA et de compilation jusqu'au runtime, au firmware et au matériel. - Sensibilité forte aux performances, avec une bonne intuition des impacts liés aux cycles processeur, aux copies mémoire et aux goulets d'étranglement. - Exigence élevée en matière de qualité logicielle, d'automatisation, de reproductibilité et de bonnes pratiques d'ingénierie. - Excellentes qualités de collaboration et de communication, avec une capacité à travailler efficacement au sein d'équipes pluridisciplinaires. - À l'aise dans un environnement international, innovant et en forte évolution. ## Description En tant que AI Runtime / Low-Level Software Engineer, vous serez responsable du développement de la couche Runtime / Offload, qui permet l'exécution efficace des charges de travail d'inférence sur notre accélérateur IA RISC-V propriétaire depuis un hôte x86. Vous rejoindrez notre équipe AI & Compute, qui développe une plateforme complète d'inférence IA générative couvrant toute la chaîne logicielle, du service d'inférence jusqu'au silicium : LLM Serving * AI Compilation * Runtime / Offload * Bibliothèques de kernels IA optimisés Vous développerez la couche logicielle bas niveau en charge de la gestion du cycle de vie des accélérateurs, de l'ordonnancement et de l'exécution des traitements, des communications hautes performances entre l'hôte et l'accélérateur, ainsi que des API Runtime utilisées par les couches de compilation et de serving. Vous participerez à la conception de cette pile logicielle de bout en bout sur une base open source et collaborerez étroitement avec les équipes Hardware, Compilateurs et IA afin d'accompagner le produit, depuis les environnements d'émulation jusqu'au silicium final. À ce titre, vous serez amené(e) à : - Développer et optimiser le runtime chargé d'exécuter les traitements d'inférence déportés, depuis l'API d'offload côté hôte jusqu'au firmware de l'accélérateur. - Concevoir et optimiser les chemins critiques de performance, notamment l'ordonnancement, la distribution des traitements, les transferts mémoire et les flux de données entre l'hôte et l'accélérateur. - Analyser et optimiser les performances du runtime en identifiant les goulets d'étranglement liés à la latence, aux transferts mémoire et à l'efficacité globale de l'exécution. - Concevoir et maintenir des API Runtime robustes et pérennes à destination des couches de compilation IA et de serving, afin de garantir une exécution optimale des charges de travail sur l'accélérateur. - Intégrer et valider les communications PCIe sur le matériel réel tout en maintenant des environnements d'émulation utilisés comme plateformes de développement et de validation continue (CI). - Mettre en place les fondations logicielles nécessaires au développement : pipelines CI/CD, tests automatisés (smoke tests) sur plateformes émulées et bonnes pratiques garantissant un haut niveau de qualité. - Collaborer avec les équipes IA, Hardware et Architecture afin d'orienter les choix techniques et d'améliorer les performances des applications IA en conditions réelles. - Participer à l'amélioration continue de l'ensemble de la pile logicielle dédiée à l'accélération IA., Team building et autre activités telles que laser game, escape game, voile, ski, karting, karaoké et bien plus encore ! Processus de recrutement : Premier entretien avec votre futur manager Second entretien technique avec l'équipe Entretien final avec la DRH ou le CEO KALRAY s'engage à promouvoir un environnement de travail fondé sur la diversité et l'inclusion. Nous accueillons les candidatures de personnes issues de tous horizons, identités et expériences. Nous ne pratiquons aucune discrimination (y compris dans nos processus de recrutement et de promotion) fondée sur la religion, la couleur de peau, l'origine, le genre, l'orientation sexuelle, l'âge, le statut… ## Related Videos - [Unleashing the Full Potential of the Arm Architecture – Write Once, Deploy Anywhere](https://www.wearedevelopers.com/videos/940-unleashing-the-full-potential-of-the-arm-architecture-write-once-deploy-anywhere) - [Docker network without Docker](https://www.wearedevelopers.com/videos/1418-docker-network-without-docker) - [Playing Pong on a shoulder press machine](https://www.wearedevelopers.com/videos/100140-playing-pong-on-a-shoulder-press-machine) - [Just-in-time Compilation in JVM](https://www.wearedevelopers.com/videos/240-just-in-time-compilation-in-jvm) - [Docker exec without Docker](https://www.wearedevelopers.com/videos/1094-docker-exec-without-docker) - [Agent Smith Gets Hardware: Autonomous IoT Hacking From Debug Port to Cloud API](https://www.wearedevelopers.com/videos/100258-agent-smith-gets-hardware-autonomous-iot-hacking-from-debug-port-to-cloud-api) ## Related Articles - [How to Become an AI Engineer](https://www.wearedevelopers.com/magazine/331-how-to-become-an-ai-engineer) - [MLOps And AI Driven Development](https://www.wearedevelopers.com/magazine/82-mlops-and-ai-driven-development) - [Navigating the AI Shift](https://www.wearedevelopers.com/magazine/629-navigating-the-ai-shift) - [Stephan Gillich - Bringing AI Everywhere](https://www.wearedevelopers.com/magazine/489-stephan-gillich-bringing-ai-everywhere) - [What Are Large Language Models?](https://www.wearedevelopers.com/magazine/304-what-are-large-language-models) - [Where to Find Entry-Level Software Engineering Jobs](https://www.wearedevelopers.com/magazine/397-where-to-find-entry-level-software-engineering-jobs)