> Markdown version of [/jobs/ext/2860504-site-reliability-engineer](https://www.wearedevelopers.com/jobs/ext/2860504-site-reliability-engineer). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Site Reliability Engineer - **Company:** gridscale GmbH - **Location:** Köln, Germany (Remote available) - **Contract:** Permanent contract - **Skills:** Artificial Intelligence, BIOS, Cloud Computing, Computer Programming, Cursor (Graphical User Interface Elements), Linux, DevOps, Firmware, Python (Programming Language), OpenStack, Ansible, Large Language Models, Kubernetes, Bare Metal, Terraform - **Published:** September 12, 2026 - **Apply:** https://www.adzuna.de/details/5880467391 ## About the Role * Du bringst mehrere Jahre praktische Erfahrung als SRE, Platform Engineer oder DevOps Engineer im Betrieb produktiver Infrastruktur mit und verfügst über fundierte Erfahrung mit OpenStack, Kubernetes und Linux, auch auf Bare Metal. * Du hast Compute-Infrastruktur bereits End-to-End betrieben - von Firmware-/BIOS-Rollouts, Bare-Metal-Provisionierung und Hardware-Diagnostik bis zu Hypervisoren, Migrationen, Host Evacuations, Graceful Drains und Capacity Rebalancing. * AI-Assisted Engineering gehört für dich bereits zum Arbeitsalltag. Du setzt LLMs und agentische Tools gezielt dort ein, wo sie Entwicklung, Testing, Reviews oder den Betrieb sinnvoll unterstützen, und kannst gut einschätzen, wo AI echten Mehrwert schafft und wo fundiertes Engineering-Know-how entscheidend bleibt. * Du arbeitest sicher mit Ansible, Terraform sowie GitOps-Workflows wie FluxCD oder ArgoCD und hast Erfahrung damit, automatisierte Prozesse stabil und reproduzierbar in Produktionsumgebungen zu betreiben. * Du bringst Erfahrung mit Go und/oder Python sowie mit Claude Code, Cursor, Aider oder vergleichbaren agentischen Coding-Umgebungen mit. * Auch Observability, Networking, Compute-Tuning, Auto-Remediation, Security-kritische Infrastrukturen und Multi-Site-Cloud-Umgebungen gehören zu deinem technischen Erfahrungsspektrum. * Du arbeitest eigenverantwortlich, bringst ein ausgeprägtes Ownership-Mindset mit und hast Freude daran, Dinge nicht nur zu betreiben, sondern kontinuierlich besser zu machen. Gleichzeitig teilst du dein Wissen gerne und kannst komplexe technische Zusammenhänge klar vermitteln. * Wir arbeiten in einem internationalen Umfeld auf Englisch. Du fühlst dich deshalb sicher dabei, technische Themen auf Englisch zu diskutieren, zu dokumentieren und gemeinsam im Team voranzutreiben. ## Description * Du konzipierst und entwickelst unsere OpenStack-basierte On-Premise-Cloud-Infrastruktur mit dem Ziel, komplette Cloud-Umgebungen hochautomatisiert auf Bare Metal ausrollen und in Betrieb nehmen zu können. * Du entwickelst und betreibst Infrastructure as Code mit Ansible und Terraform sowie unsere Kubernetes- und GitOps-Workflows mit FluxCD / ArgoCD - unterstützt durch LLMs, agentische Workflows und automatisierte Test- und Review-Prozesse. * Du verantwortest den Lifecycle unserer Compute-Infrastruktur - von Bare Metal, Firmware und Provisionierung bis zu Hypervisoren und virtuellen Compute Nodes. Dazu gehören unter anderem Patching, Migrationen, Host Evacuations, Capacity Rebalancing und die Automatisierung eines stabilen Plattformbetriebs. * Du entwickelst unser AI Substrate und unsere Self-Healing-Strategie weiter - von strukturierten Knowledge Bases und agentischen Workflows für Incident Triage und Capacity Planning bis hin zur schrittweisen Automatisierung heutiger Runbooks. * Du konzipierst Tests für Non-Regression, Performance und Security, dokumentierst und paketierst Lösungen und verbesserst die Plattform kontinuierlich anhand von Telemetrie, Betriebserfahrungen und Nutzerfeedback. * Als Senior Engineer bist du technische Ansprechperson und Sparringspartner für Kolleg rund um Automation, Platform Engineering und AI Tooling. ## Related Videos - [From DevOps to Scaled DevOps: How We’re Rebuilding Continuous Delivery as a Platform](https://www.wearedevelopers.com/videos/100018-from-devops-to-scaled-devops-how-we-re-rebuilding-continuous-delivery-as-a-platform) - [Docker network without Docker](https://www.wearedevelopers.com/videos/1418-docker-network-without-docker) - [10M Data Records Lost, Underwater Computing, and Psychedelic Fish - Matthias Geniar](https://www.wearedevelopers.com/videos/1908-10m-data-records-lost-underwater-computing-and-psychedelic-fish-matthias-geniar) - [Navigating the Corporate Jungle: Life as a Developer in a large Company](https://www.wearedevelopers.com/videos/621-navigating-the-corporate-jungle-life-as-a-developer-in-a-large-company) - [#90DaysOfDevOps - The DevOps Learning Journey](https://www.wearedevelopers.com/videos/548-90daysofdevops-the-devops-learning-journey) - [DevOps Maturity Check – a way to balance autonomy and alignment](https://www.wearedevelopers.com/videos/58-devops-maturity-check-a-way-to-balance-autonomy-and-alignment) ## Related Articles - [Finding Jobs in Germany](https://www.wearedevelopers.com/magazine/375-finding-jobs-in-germany) - [Finding IT & Technology English-speaking Jobs in Germany ](https://www.wearedevelopers.com/magazine/446-finding-it-technology-english-speaking-jobs-in-germany) - [The Biggest German Tech Companies](https://www.wearedevelopers.com/magazine/424-the-biggest-german-tech-companies) - [Where to Find German Tech Jobs](https://www.wearedevelopers.com/magazine/366-where-to-find-german-tech-jobs) - [Where To Find Software Engineering Jobs](https://www.wearedevelopers.com/magazine/396-where-to-find-software-engineering-jobs) - [Is Software Engineering Over-Saturated?](https://www.wearedevelopers.com/magazine/418-is-software-engineering-over-saturated)