Beschäftigte*r als DevOps / MLOps Engineer

RWTH Aachen
Aachen, Germany
8 days ago

Role details

Contract type
Temporary contract
Employment type
Part-time / full-time
Working hours
Regular working hours
Languages
English, German

Tech stack

.NET Framework Application Programming Interfaces (APIs) Artificial Intelligence Software System Penetration Testing Bash Shell C Sharp (Programming Language) Cloud Computing Linux DevOps Python (Programming Language) Machine Learning Open Source Technology
+19 more
Performance Tuning Regression Testing Prometheus Shell Script Software Engineering Test Management Load Balancing High Performance Computing Large Language Models Grafana Parallel Computation Script Language Kubernetes Information Technology Slurm Machine Learning Operations Vimeo Docker Microservices

Job description

Die HPC-Gruppe PRAM des IT Centers entwickelt in enger Zusammenarbeit mit dem Lehrstuhl für Informatik 12 kontinuierlich ihre Methodenkompetenz im Bereich Hochleistungsrechnen und Künstlicher Intelligenz auf HPC-Systemen weiter. Die Hauptaufgaben dieser Arbeitsgruppe umfassen sowohl die Forschung als auch die methodische Unterstützung der Nutzerinnen und Nutzer bei Fragen zur Programmentwicklung, Fehlersuche, Performance-Tuning und Parallelisierung. Zudem stellt die Gruppe die erforderlichen Werkzeuge und Hilfsmittel für diese Aufgaben bereit.

Zu Ihrem Aufgabenbereich gehören:

Konzeption und Realisierung eines einheitlichen KI-Gateways

  • Weiterentwicklung eines standortübergreifenden Inferenz-Gateways, das Ressourcen aus unterschiedlichen Systemen (HPC-Cluster, Kubernetes-Umgebungen) zusammenführt.
  • Definition, Implementierung und Pflege standardisierter APIs/Schnittstellen für den einheitlichen Zugriff auf die Inferenz-Backends.

Deployment von Large-Language-Modellen (LLMs), Load Balancing und Monitoring

  • Konfiguration, Deployment und Optimierung der Ausführung von Open-Source bzw. Open-Weight-LLMs auf Hochleistungsrechnern (HPC) sowie in Kubernetes-Clusters.
  • Anpassung der Betriebsbedingungen (Ressourcenzuweisung, Skalierung, Container-Images) an die jeweiligen Hosting-Szenarien.
  • Sicherstellung einer skalierbaren Lastverteilung, hohen Resilienz und Redundanz sowohl auf Ebene des Gateways als auch der lokalen Inferenz-Cluster.
  • Weiterentwicklung und Konfiguration des Monitorings für die Inferenz-Infrastruktur und einzelne Modell-Instanzen (Metriken, Alerting, Dashboarding).

Qualitätssicherung und Testmanagement

  • Konzeption und Durchführung automatisierter Regression-Tests für KI-Modelle (Performance, Funktionalität, verschiedene Modalitäten).
  • Planung und Begleitung von Last- und Penetrationstests der gesamten Inferenz-Infrastruktur zur Gewährleistung von Sicherheit und Robustheit.

Design, Implementierung und Integration agentischer KI-Workflows

  • Unterstützung bei Konzeption und Umsetzung von agenten-basierten Prozessen (z. B. Retrieval-Augmented-Generation), die die bereitgestellten KI-Modelle nutzen.
  • Einbindung der Inferenz-Ressourcen in RAG-Setups sowie Anbindung an Model-Context-Protocol (MCP) Services zur nahtlosen Orchestrierung.

Requirements

  • Ein erfolgreich abgeschlossenes Hochschulstudium (Master oder vergleichbar) in der Informatik, den Natur- oder Ingenieurwissenschaften oder eine vergleichbare Qualifikation.
  • Sie besitzen fundierte Erfahrung im Umgang mit Linux-Systemen, inklusive Shell-Scripting sowie Paket- und Service-Management.
  • Sie verfügen über sichere Kenntnisse in Skriptsprachen (z. B. Bash, Python) und objekt-orientierten Programmiersprachen, vorzugsweise in C#/.NET.
  • Sie haben praktische Erfahrung mit Container-Technologien und deren Orchestrierung, zum Beispiel Docker, Docker Compose und Kubernetes.
  • Gute Kenntnisse in Deutsch und Englisch (mündlich sowie schriftlich)

Idealerweise ergänzen folgende Kenntnisse und Erfahrungen Ihr Profil:

  • Praktische Erfahrung mit der Ausführung von KI-Modellen mit Hilfe von Inferenz-Plattformen oder Frameworks (z. B. Deployment von LLMs, Model-Serving).
  • Sicherer Umgang mit Hochleistungs-Clustern und gängigen Schedulern (z. B. SLURM, PBS, LSF) zur Submittierung und Verwaltung von Rechen-Jobs.
  • Kenntnisse im automatisierten Testen von KI-Modellen, inklusive Regressionstests sowie Last- und Penetrationstests.
  • Erfahrung in der Gestaltung von Micro-Service-Architekturen und der Implementierung von REST- bzw. gRPC-Schnittstellen
  • Vertrautheit mit Observability-Tools wie Prometheus, Grafana, Loki oder ähnlichen Stacks.
  • Praktische Erfahrung mit Retrieval-Augmented-Generation (RAG) und agentischen KI-Workflows
  • Begeisterung für Parallelisierung, High-Performance-Computing und aktuelle Anwendungsfelder im Bereich Künstliche Intelligenz und Machine Learning.
  • Persönlich überzeugen Sie durch Ihre hohe Motivation, Ihr Engagement sowie Ihre ausgeprägte soziale Kompetenz. Sie arbeiten gerne im Team, übernehmen Verantwortung und bringen sich aktiv mit Ihren Ideen ein.

Benefits & conditions

Digitalisierung, Cloud, Security und die dazugehörige IT-Infrastruktur - tagtäglich begegnen uns diese Begriffe in den Medien. Im IT Center sind Sie ganz nah dran an diesen Entwicklungen und können in diesen Bereichen auch etwas bewegen. Wir arbeiten mit den aktuellsten Technologien und sind damit ein erfolgreicher IT-Dienstleister. Der Erfolg des IT Centers basiert dabei nur bedingt auf den neuesten Technologien oder den schnellsten Rechnern, sondern in erster Linie auf den Mitarbeitenden, die sich mit großem Engagement für das IT Center einsetzen und neben großem Fachwissen gemeinsam mit den Führungskräften für eine sehr gute Arbeitsatmosphäre sorgen., Im IT Center erwarten Sie abwechslungsreiche Tätigkeiten in einem motivierten, aufgeschlossenen und leistungsbereiten Team mit einer wertschätzenden Umgangskultur., Die Einstellung erfolgt im Beschäftigtenverhältnis. Die Stelle ist zum nächstmöglichen Zeitpunkt zu besetzen und befristet bis zum 31.12.2030. Die Befristung richtet sich nach § 14 Abs. 1 Teilzeit- und Befristungsgesetz (TzBfG). Es handelt sich um eine Vollzeitstelle. Die Eingruppierung richtet sich nach dem TV-L. Die Stelle ist bewertet mit EG 13.

About the company

Als die zentrale IT-Einrichtung der RWTH Aachen University steht das IT Center seit über 60 Jahren für Qualität in verschiedensten Bereichen. Das IT Center unterstützt die Lehr- und Forschungsaufgaben und zentralen Prozesse der Hochschule und erbringt Basisdienste und individuelle Dienstleistungen für die Hochschuleinrichtungen., Die RWTH bietet im Rahmen eines Universitären Gesundheitsmanagements eine Vielzahl von Gesundheits-, Beratungs- und Präventionsangeboten (z. B. Hochschulsport) an. Für Tarifbeschäftigte und Beamtinnen und Beamte besteht ein umfangreiches Weiterbildungsangebot und die Möglichkeit, ein Jobticket zu erwerben. Die Stellenausschreibung richtet sich an alle Geschlechter. Wir wollen an der RWTH Aachen University besonders die Karrieren von Frauen fördern und freuen uns daher über Bewerberinnen. Frauen werden bei gleicher Eignung, Befähigung und fachlicher Leistung bevorzugt berücksichtigt, sofern sie in der Organisationseinheit unterrepräsentiert sind und sofern nicht in der Person eines Mitbewerbers liegende Gründe überwiegen.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.rwth-aachen.de

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:22 min

Infrastructure barriers and compliance risks in research

Jeremy Murray Jeremy Murray · WWC Europe 2026

52 sec

Running persistent Linux environments directly on Windows

Ben Breard Ben Breard · WWC 2025

2:47 min

Exploring career opportunities and recruitment open positions

Kurt Eder · LIVE

1:51 min

Managing GPU quotas and multi-tenancy with Kueue

Jeremy Murray Jeremy Murray · WWC Europe 2026

2:27 min

Structuring agile and interdisciplinary engineering teams

Oliver Zimmert · LIVE

3:55 min

Demonstrating .NET installation on Debian and Azure Linux

Silvano Coriani Silvano Coriani · Europe 2026 Virtual

Videos

See all

Related articles

See all