> Markdown version of [/jobs/ext/2465728-senior-platform-operations-engineer-site-reliability-engineer](https://www.wearedevelopers.com/jobs/ext/2465728-senior-platform-operations-engineer-site-reliability-engineer). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # Senior Platform Operations Engineer / Site Reliability Engineer - **Company:** n_value group - **Location:** Germany (Remote available) - **Experience:** Expert - **Contract:** Permanent contract - **Skills:** Systems Engineering, Bash Shell, Cloud Computing, Communications Protocols, Continuous Integration, Linux, Elasticsearch, Information Technology Operations, Python (Programming Language), Networking Basics, Reliability Engineering, Prometheus, Software Engineering, Grafana, Git, Kubernetes, Restful APIs, Elk Stack, Jenkins - **Published:** August 28, 2026 - **Apply:** https://de.indeed.com/viewjob?jk=ad966d1ee4efb01f ## About the Role Must-have * Mehrjährige Erfahrung im Bereich Platform Operations, Site Reliability Engineering, System Engineering oder IT Operations * Bereitschaft zur Durchführung bzw. Vorliegen einer Sicherheitsüberprüfung SÜ2 * Sehr gute Kenntnisse in Linux-basierten Umgebungen * Verständnis für Kubernetes und containerisierte Plattformen * Praxiserfahrung mit: + Prometheus + Grafana + ELK Stack oder OpenSearch + Elasticsearch oder OpenSearch * Erfahrung im Monitoring, Alerting und Observability-Umfeld * Gute Kenntnisse von Netzwerkgrundlagen und Kommunikationsprotokollen * Erfahrung im Umgang mit REST APIs * Sicherer Umgang mit Git * Analytische Herangehensweise bei Fehleranalysen und Störungsbehebung * Gute Englischkenntnisse in Wort und Schrift * Bereitschaft zur Teilnahme an Rufbereitschaften und Schichtbetrieb Nice-to-have * Erfahrung mit ArgoCD * Kenntnisse in Jenkins * Erfahrung mit Helm * Bash-Scripting * Python für Betriebsautomation und Operational Excellence * Erfahrung im Bereich Site Reliability Engineering (SRE) * Kenntnisse moderner Cloud- oder Plattformarchitekturen ## Description Sichere und betreibe moderne Plattformen auf Enterprise-Niveau. Du begeisterst dich für hochverfügbare Plattformen, Monitoring-Lösungen und den stabilen Betrieb komplexer Kubernetes-Umgebungen? Dann suchen wir genau dich. Als Senior Platform Operations Engineer (m/w/d) übernimmst du eine zentrale Rolle im Betrieb und der Weiterentwicklung moderner Plattform- und Observability-Lösungen. Dein Fokus liegt nicht auf klassischer Softwareentwicklung, sondern auf der Sicherstellung von Stabilität, Verfügbarkeit und Performance geschäftskritischer Systeme. Du arbeitest an den Themen Monitoring, Observability, Incident Management, Kubernetes Operations sowie Automation im Betriebsumfeld und sorgst gemeinsam mit unserem Team für einen zuverlässigen Plattformbetrieb. Deine Aufgaben * Betrieb, Betreuung und Weiterentwicklung von Monitoring- und Observability-Plattformen * Administration und Optimierung von Prometheus, Grafana sowie OpenSearch / ELK * Überwachung produktiver Systemlandschaften und kontinuierliche Verbesserung von Monitoring- und Alerting-Konzepten * Bearbeitung von Incidents sowie Unterstützung bei der Wiederherstellung kritischer Services * Durchführung von Root Cause Analysen und nachhaltige Beseitigung von Störungsursachen * Unterstützung bei Major Incidents und Koordination technischer Lösungsmaßnahmen * Betrieb und Optimierung containerisierter Plattformen auf Basis von Kubernetes * Unterstützung von CI/CD-Prozessen mit Jenkins und ArgoCD * Erstellung, Pflege und Weiterentwicklung von Runbooks, Betriebsprozessen und technischer Dokumentation * Automatisierung wiederkehrender Betriebsaufgaben * Teilnahme an Rufbereitschaften und Schichtmodellen in einer 24x7-Betriebsorganisation ## Related Videos - [Navigating the Corporate Jungle: Life as a Developer in a large Company](https://www.wearedevelopers.com/videos/621-navigating-the-corporate-jungle-life-as-a-developer-in-a-large-company) - [The Road to MLOps: How Verivox Transitioned to AWS](https://www.wearedevelopers.com/videos/1050-the-road-to-mlops-how-verivox-transitioned-to-aws) - [Docker network without Docker](https://www.wearedevelopers.com/videos/1418-docker-network-without-docker) - [How a Small Team Shrank a Microsoft Monorepo by 94%](https://www.wearedevelopers.com/videos/1236-how-a-small-team-shrank-a-microsoft-monorepo-by-94) - [Enterprise-Cloud-Native - Fast-Paced Development & Deployment in a Highly Secure Banking Environment](https://www.wearedevelopers.com/videos/671-enterprise-cloud-native-fast-paced-development-deployment-in-a-highly-secure-banking-environment) - [Our GitOps approach for deploying an Identity Provider and an API Gateway in a SaaS company](https://www.wearedevelopers.com/videos/776-our-gitops-approach-for-deploying-an-identity-provider-and-an-api-gateway-in-a-saas-company) ## Related Articles - [Finding Jobs in Germany](https://www.wearedevelopers.com/magazine/375-finding-jobs-in-germany) - [Finding IT & Technology English-speaking Jobs in Germany ](https://www.wearedevelopers.com/magazine/446-finding-it-technology-english-speaking-jobs-in-germany) - [Where to Find German Tech Jobs](https://www.wearedevelopers.com/magazine/366-where-to-find-german-tech-jobs) - [The Biggest German Tech Companies](https://www.wearedevelopers.com/magazine/424-the-biggest-german-tech-companies) - [Where To Find Software Engineering Jobs](https://www.wearedevelopers.com/magazine/396-where-to-find-software-engineering-jobs) - [Fullstack developer salary in Germany [2023]](https://www.wearedevelopers.com/magazine/197-fullstack-developer-salary-in-germany-2023)