Machine Learning Engineer - Foundation Models
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Tech stack
+7 more
Job description
- Du entwickelst und trainierst unsere domänenspezifischen Vision-Modelle auf Basis aktueller State-of-the-Art-Architekturen und nutzt unsere Abfallbild-Datenbasis fßr Pretraining und Continued Pretraining
- Du gestaltest unsere komplette ML-Trainings-Pipeline: von der Datenaufbereitung Ăźber verteiltes Training (PyTorch FSDP/DDP, Mixed Precision) bis zur Modell-Versionierung
- Du baust und pflegst unsere Eval Suite - die zentrale Infrastruktur, die misst, ob unsere Modelle wirklich besser werden: Linear Probing, k-NN-Probing, Few-Shot-Detection, Cross-Domain-Generalization, Anomalie-Detection
- Du finetunst und destillierst unsere Modelle fĂźr konkrete Downstream-Tasks und Edge-Hardware (Sortieranlagen, GPU-Inferenz)
- Du analysierst Trainings-Runs systematisch, identifizierst Probleme wie Feature Collapse oder Domain Shift und entwickelst nachhaltige LĂśsungen statt kurzfristiger Workarounds
- Du arbeitest eng mit dem Cloud-Backend-Team zusammen, um Modelle effizient ins Deployment zu bringen (ONNX, TensorRT, OpenVINO), * Arbeit auf der âgrĂźnen Wieseâ - Aufbau einer eigenen Foundation-Model-Strategie ohne Altlasten oder technische Schulden
- Zugang zu einer einzigartigen, wachsenden Datenbasis aus realen Sortieranlagen - ein strategischer Vorteil, den keine Universität und kaum ein Wettbewerber hat
- Einsatz aktueller Frameworks und eines top-modernen Tech-Stacks (PyTorch 2.x, FSDP, Hydra, W&B, DVC, timm)
- Substanzielle Compute-Ressourcen fĂźr Pretraining-Runs - wir wissen, dass ernsthaftes Foundation-Model-Training kein Hobby-Projekt ist
- Enge Zusammenarbeit mit Forschungspartnern (u.a. THWS WĂźrzburg im Rahmen von Green-INNO) und die MĂśglichkeit, eigene Forschungsergebnisse zu publizieren
- Arbeiten in einem dynamischen und interdisziplinären Start-Up-Team mit viel Verantwortung und Gestaltungsspielraum von Anfang an
- Kurze Entscheidungswege und eine Kommunikation ohne Umwege
- Technologie mit Sinn: Du arbeitest an den grĂśĂten Hebeln unserer Zeit - KI, Recycling und Circular Economy
Requirements
B AusĂźbungsformen
Gewßnschte Fähigkeiten & Kenntnisse
Machine Learning Infrastruktur LiNear SQL Azure Edge Datenaufbereitung Cloud START AWS Englisch Open Source Optimierung Entwicklungsumgebungen Kommunikation Deutsch Analytisches Denken Verantwortungsvolle Arbeitsweise Sorgfältige Arbeitsweise, * Du verfolgst aktiv die Forschungsentwicklung im Bereich Computer Vision und ßbersetzt relevante Paper in produktive LÜsungen
-
Du denkst Ăźber das Modell hinaus und hast im Blick, wie deine Arbeit im realen Betrieb wirkt - fĂźr Sortieranlagen, Kunden und das Gesamtsystem Damit begeisterst du uns
- Du bringst mehrjährige Erfahrung in der Entwicklung und im Training von Computer-Vision-Modellen mit, idealerweise mit modernen Vision-Transformer-Architekturen und Self-Supervised-Learning-Methoden
- Du beherrschst PyTorch sicher - inklusive verteiltem Training (DDP, FSDP), gemischter Präzision (bf16/fp16) und Performance-Optimierung (torch.compile, Profiling)
- Du verstehst nicht nur, wie man ein Modell trainiert, sondern auch wie man evaluiert. Du weiĂt, dass eine schwache Eval Suite jedes Pretraining wertlos macht
- Du hast Erfahrung mit modernen ML-Tooling-Stacks fĂźr Konfigurations-Management, Experiment-Tracking, Daten-Versionierung und Backbone-Bibliotheken
- Du nutzt moderne KI-Tools (z.B. Claude, Copilot), um Routine-Coding zu beschleunigen und dich auf die wirklich harten Forschungs- und Architekturfragen zu konzentrieren
- Du hast ein gutes Verständnis fĂźr Datenpipelines bei groĂen Datenmengen (Millionen Bilder): effiziente Datenformate, GPU-Augmentations, I/O-Bottlenecks
- Erfahrung mit gängigen Detection-/Segmentation- sowie Anomalie-Detection-Frameworks ist von Vorteil
- Du kennst dich mit Inferenz-Optimierung und Modell-Distillation aus und hast idealerweise schon Modelle auf Edge-Hardware deployed
- Ausgeprägte ProblemlÜsefähigkeit, analytisches Denken und wissenschaftliche Sorgfalt - du arbeitest hypothesengetrieben und nicht nach dem Try-and-Error-Prinzip
- Sicherer Umgang mit Cloud-GPU-Infrastruktur (AWS, Azure, GCP oder On-Premise H100/A100-Cluster)
- FlieĂende Deutsch- sowie gute Englischkenntnisse werden vorausgesetzt
- Idealerweise hast du eigene Forschungserfahrung (Paper, Open-Source-Beiträge, Konferenz-Talks) oder bist promoviert - kein Muss, aber ein Plus
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Talks and stories from around this role â technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
MLops â Deploying, Maintaining And Evolving Machine Learning Models in Production
MLOps â Whatâs the deal behind it?
System change: restart as developer?
How to Become an AI Engineer