> Markdown version of [/jobs/ext/3586392-site-reliability-engineer](https://www.wearedevelopers.com/jobs/ext/3586392-site-reliability-engineer). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Site Reliability Engineer - **Company:** IONOS SE - **Location:** Karlsruhe, Germany - **Contract:** Permanent contract - **Skills:** Bash Shell, Cloud Computing, Information Systems, Continuous Integration, Linux, DevOps, Github, Python (Programming Language), Octopus Deploy, Prometheus, Data Logging, Fluentd, Grafana, Kubernetes Helm Charts, Gitlab-ci, Kubernetes, Operational Systems, Terraform, Elk Stack, Golang - **Published:** October 5, 2026 - **Apply:** https://www.careerjet.de/jobad/ded96c5de91f63289534d48da4846fe42d ## About the Role * Du hast mehrjährige Erfahrung als Site Reliability Engineer oder in einer verwandten Rolle (Linux System Administrator, Platform Engineer, DevOps Engineer, Full Stack Developer) in einem Linux und Kubernetes Umfeld. * Sehr gute Kenntnisse und mehrjährige Erfahrung in der Verwendung des Linux Betriebssystems, Container-Technologien sowie speziell in Kubernetes. * Du hast Erfahrung mit Infrastructure as Code (vorzugsweise Terraform), CI/CD-Pipelines (z. B. GitLab CI/CD oder GitHub Actions) und in der Nutzung und Verwendung von Helm Charts. * Du kannst sicher in mindestens einer Programmier- oder Skriptsprache (z. B. Go, Python, Bash) entwickeln, um Automatisierungs- und Monitoring-Aufgaben zu lösen und hast eventuell schon erste Erfahrungen im Bau von Operatoren gesammelt. * Erfahrung mit dem Betrieb und der Fehlersuche in hochverfügbaren und verteilten Produktionsumgebungen, einschließlich der Überwachung, der Alarmierung und der Protokollanalyse verteilter Anwendungen (z. B. Prometheus, Grafana, FluentD, ELK, VictoriaMetrics, icinga). * Du hast eine proaktive, lösungsorientierte, selbstständige Arbeitsweise und die Fähigkeit, komplexe technische Probleme systematisch zu analysieren und nachhaltig zu beheben. * Gute Deutsch- und Englischkenntnisse sind erforderlich. ## Description * Dein Haupteinsatzbereich ist die Weiterentwicklung der Infrastruktur/Plattform unserer Produkte, sowie die Integration neuer Produkte/Webdienste in unsere Kubernetes - und Cloud - Infrastruktur. * Du bist verantwortlich für den stabilen und sicheren Betrieb unserer Produktplattform. Deine Expertise ist gefragt, wenn es um tiefgreifende Analysen und die Optimierung unserer primär containerisierten und Kubernetes-basierten Anwensungsinfrastruktur geht. * Du lebst Automatisierung. Mit Tools wie Terraform, Gitlab CI/CD und ArgoCD provisionierst und verwaltest du unsere gesamte Infrastruktur deklarativ und reproduzierbar. * Du analysierst und behebst komplexe Probleme in einer verteilten Systemlandschaft und arbeitest an der stetigen Verbesserung unserer Plattform. * Du entwickelst und pflegst unsere Monitoring-, Logging- und Alerting-Lösung (z. B. mit Prometheus, Grafana, ELK-Stack), um proaktiv Engpässe und Fehlerquellen zu identifizieren., * Hybrides Arbeitsmodell. * Flexible Arbeitszeiten durch Vertrauensarbeitszeit. * An einigen Standorten eine bezuschusste Kantine und verschiedene kostenfreie Getränke. * Moderne Büroflächen mit sehr guter Verkehrsanbindung. * Diverse Mitarbeiterrabatte für Aktivitäten und Produkte. * Mitarbeiterevents wie Sommer- und Winterfeiern, sowie Workshops. * Zahlreiche Weiterbildungs- und Entwicklungsmöglichkeiten. * Verschiedene Gesundheitsangebote, wie Sport- und Gesundheitskurse.