Sovereign AI Plattform Engineer /x)
Role details
Job location
Tech stack
Requirements
Über die PositionAls Platform Engineer mit Schwerpunkt Sovereign AI entwickeln, implementieren und betreiben Sie eine sichere und leistungsfähige KI-Toolchain für den Einsatz in isolierten oder besonders geschützten IT-Umgebungen. Sie gestalten Kubernetes-basierte Plattformen für KI-Inferenz, Retrieval, Experimente und agentenbasierte Anwendungen. Dabei integrieren und betreiben Sie Open-Source- und Open-Weight-Modelle, Model-Serving-Lösungen, Model Gateways, Vektordatenbanken sowie interne Benutzeroberflächen und Schnittstellen. Mit Infrastructure as Code, GitOps und automatisierten Deployment-Prozessen schaffen Sie stabile, reproduzierbare und auditierbare Plattformumgebungen. Sie verwalten private Registries, lokale Paket- und Modell-Repositories, Secrets, Zugriffsrechte, Storage, Netzwerkkomponenten und Observability-Lösungen in Umgebungen mit eingeschränkter oder vollständig unterbundener Anbindung an öffentliche Cloud-Dienste. Darüber hinaus optimieren Sie GPU-, CPU-, Storage- und Netzwerkressourcen für zuverlässige KI-Workloads und stellen sicher, dass Sicherheits-, Audit- und Datensouveränitätsanforderungen eingehalten werden. Must-have-Kenntnisse
- Mindestens fünf Jahre Erfahrung im Platform Engineering, DevOps, Site Reliability Engineering oder MLOps
- Sehr gute Kenntnisse in Kubernetes und Linux
- Erfahrung mit KI-Infrastrukturen, Model Serving und LLM-basierten Anwendungen
- Erfahrung mit privaten, On-Premises- oder isolierten Deployment-Umgebungen
- Gute Kenntnisse in Python, Terraform, Ansible, Helm und GitOps
- Fundierte Kenntnisse in den Bereichen Netzwerk, Storage, Zugriffskontrolle und Monitoring
- Erfahrung mit GPU-gestützten Plattformen und der Optimierung von KI-Workloads
- Sehr gutes Verständnis von IT-Sicherheit, Datensouveränität und auditierbaren Betriebsmodellen
- Sehr gute Deutschkenntnisse in Wort und Schrift auf C1-Niveau
Nice-to-have-Kenntnisse
- Erfahrung mit vLLM, Ollama, llama.cpp oder vergleichbaren Model-Serving-Lösungen
- Kenntnisse im Umgang mit Open-Source- oder Open-Weight-Modellen
- Erfahrung mit Vektordatenbanken wie Qdrant und Retrieval-Augmented Generation
- Kenntnisse in Argo CD, privaten Registries und lokalen Paket- oder Modell-Repositories
- Erfahrung mit Open WebUI oder vergleichbaren internen KI-Oberflächen
- Kenntnisse in GPU-Scheduling, LLMOps, Observability und Air-Gap-Umgebungen
- Erfahrung mit VS-Code-kompatiblen Integrationen und internen KI-Schnittstellen
About the company
Die Deutsche Telekom ist Europas größtes Telekommunikationsunternehmen und weltweit in mehr als 50 Ländern vertreten. Mit rund 207.000 Mitarbeitenden erwirtschaftete sie im Geschäftsjahr 2022 einen Umsatz von 114,4 Milliarden Euro.
Wir entwickeln Technologie und Innovationen für Menschen, Umwelt und Unternehmen, um damit gemeinsame Herausforderungen zu bewältigen.
Sei dabei und gestalte mit uns die Zukunft, mache den Alltag einfacher und sicherer mit KI, entwickle Lösungen für das Internet der Dinge oder digitalisiere Prozesse mit uns als Marktführer im Bereich Cloud Computing.
Bei der Telekom teilen wir mehr als den Arbeitgeber. Wir teilen die gleichen Werte und setzen uns für diese ein. Unser Ziel ist es, den stetigen Wandel zu treiben und ihn zu nutzen, um die Welt zu einem inklusiveren und lebenswerteren Ort zu machen. Nur indem wir den Status quo hinterfragen, können wir ein besseres Morgen erschaffen. Jede und jeder von uns kann ein Katalysator für Veränderung und dieser Funke der Inspiration sein, der Fortschritt ermöglicht. Ob du Einsteiger*in bist oder bereits begonnen hast, bevor es Computer Displays gab: Wenn du den Willen hast, Dinge zu verändern, mit uns gemeinsam auf die Reise gehen und in einem globalen Netzwerk wachsen willst, bist du hier richtig!
#QuestionTodayCreateTomorrow
Werde Teil von uns: www.telekom.com/de/karriere/question-today-create-tomorrow