Site Reliability Engineer
gridscale GmbH
Köln, Germany
1 day ago
- Discuss this with your agent
- Open in Claude
- Open in ChatGPT
Apply on www.adzuna.de
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Role details
Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Shift work
Languages
English
Job source
Tech stack
Artificial Intelligence
BIOS
Cloud Computing
Computer Programming
Cursor (Graphical User Interface Elements)
Linux
DevOps
Firmware
Python (Programming Language)
OpenStack
Ansible
Large Language Models
+3 more
Kubernetes
Bare Metal
Terraform
Job description
- Du konzipierst und entwickelst unsere OpenStack-basierte On-Premise-Cloud-Infrastruktur mit dem Ziel, komplette Cloud-Umgebungen hochautomatisiert auf Bare Metal ausrollen und in Betrieb nehmen zu können.
- Du entwickelst und betreibst Infrastructure as Code mit Ansible und Terraform sowie unsere Kubernetes- und GitOps-Workflows mit FluxCD / ArgoCD - unterstützt durch LLMs, agentische Workflows und automatisierte Test- und Review-Prozesse.
- Du verantwortest den Lifecycle unserer Compute-Infrastruktur - von Bare Metal, Firmware und Provisionierung bis zu Hypervisoren und virtuellen Compute Nodes. Dazu gehören unter anderem Patching, Migrationen, Host Evacuations, Capacity Rebalancing und die Automatisierung eines stabilen Plattformbetriebs.
- Du entwickelst unser AI Substrate und unsere Self-Healing-Strategie weiter - von strukturierten Knowledge Bases und agentischen Workflows für Incident Triage und Capacity Planning bis hin zur schrittweisen Automatisierung heutiger Runbooks.
- Du konzipierst Tests für Non-Regression, Performance und Security, dokumentierst und paketierst Lösungen und verbesserst die Plattform kontinuierlich anhand von Telemetrie, Betriebserfahrungen und Nutzerfeedback.
- Als Senior Engineer bist du technische Ansprechperson und Sparringspartner für Kolleg rund um Automation, Platform Engineering und AI Tooling.
Requirements
- Du bringst mehrere Jahre praktische Erfahrung als SRE, Platform Engineer oder DevOps Engineer im Betrieb produktiver Infrastruktur mit und verfügst über fundierte Erfahrung mit OpenStack, Kubernetes und Linux, auch auf Bare Metal.
- Du hast Compute-Infrastruktur bereits End-to-End betrieben - von Firmware-/BIOS-Rollouts, Bare-Metal-Provisionierung und Hardware-Diagnostik bis zu Hypervisoren, Migrationen, Host Evacuations, Graceful Drains und Capacity Rebalancing.
- AI-Assisted Engineering gehört für dich bereits zum Arbeitsalltag. Du setzt LLMs und agentische Tools gezielt dort ein, wo sie Entwicklung, Testing, Reviews oder den Betrieb sinnvoll unterstützen, und kannst gut einschätzen, wo AI echten Mehrwert schafft und wo fundiertes Engineering-Know-how entscheidend bleibt.
- Du arbeitest sicher mit Ansible, Terraform sowie GitOps-Workflows wie FluxCD oder ArgoCD und hast Erfahrung damit, automatisierte Prozesse stabil und reproduzierbar in Produktionsumgebungen zu betreiben.
- Du bringst Erfahrung mit Go und/oder Python sowie mit Claude Code, Cursor, Aider oder vergleichbaren agentischen Coding-Umgebungen mit.
- Auch Observability, Networking, Compute-Tuning, Auto-Remediation, Security-kritische Infrastrukturen und Multi-Site-Cloud-Umgebungen gehören zu deinem technischen Erfahrungsspektrum.
- Du arbeitest eigenverantwortlich, bringst ein ausgeprägtes Ownership-Mindset mit und hast Freude daran, Dinge nicht nur zu betreiben, sondern kontinuierlich besser zu machen. Gleichzeitig teilst du dein Wissen gerne und kannst komplexe technische Zusammenhänge klar vermitteln.
- Wir arbeiten in einem internationalen Umfeld auf Englisch. Du fühlst dich deshalb sicher dabei, technische Themen auf Englisch zu diskutieren, zu dokumentieren und gemeinsam im Team voranzutreiben.
Benefits & conditions
- Eine Plattform im echten Build Mode mit viel Gestaltungsspielraum, sichtbarem Einfluss auf Architekturentscheidungen und einem erfahrenen Senior-Team, in dem Autonomie und Ownership zählen.
- AI-Augmented Engineering als fester Bestandteil unserer Arbeitsweise - mit Claude Code und vergleichbaren agentischen Tools, Markdown-basierten Knowledge Bases und Raum, unsere Engineering-Praxis aktiv weiterzuentwickeln.
- Außergewöhnlicher Teamspirit über alle Abteilungen und Ländergrenzen hinweg - wir leben #OneTeam.
- Spannende Aufgaben in einem hochinnovativen und internationalen Umfeld mit modernsten Technologien.
- 32 Urlaubstage, die sich mit zunehmender Betriebszugehörigkeit erhöhen.
- Flexible Arbeitszeiten, Homeoffice-Möglichkeiten und eine sichere, unbefristete Anstellung mit markt- und leistungsorientierter Vergütung.
- Arbeitgeberfinanzierte Altersvorsorge und ein attraktives Versicherungspaket.
- OVHcloud übernimmt 50 % der Kosten für den öffentlichen Nahverkehr.
- Bis zu 400 € jährlicher Zuschuss für Sportaktivitäten, zum Beispiel Fitnessstudio oder Sportkurse.
- Attraktive Rabatte bei zahlreichen Shops und Unternehmen über Corporate Benefits.
- Wir beteiligen uns am Leasing deines Cargo Bikes.
- Regelmäßige Company Events sowie kostenlose Kalt- und Heißgetränke.
Apply for this position
This job is hosted externally. Click below to view the full posting and apply.
Apply on www.adzuna.de
Prepare application
- Draft this with your agent
- Open in Claude
- Open in ChatGPT
Good distractions
Talks and stories from around this role — technically off-topic, practically not.
Moments
Explore playlistsVideos
See allRelated articles
See all
LM
Luis Minvielle
over 2 years ago
LM
Luis Minvielle
Finding IT & Technology English-speaking Jobs in Germany
over 2 years ago
LM
Luis Minvielle
The Biggest German Tech Companies
over 2 years ago
EM
Eli McGarvie
Where to Find German Tech Jobs
over 2 years ago
LM
Luis Minvielle
Where To Find Software Engineering Jobs
over 2 years ago
LM
Luis Minvielle
Is Software Engineering Over-Saturated?
over 2 years ago