System Engineer/Site Reliability Engineer
Atruvia AG
Münster, Germany
yesterday
Role details
Contract type
Permanent contract Employment type
Part-time / full-time Working hours
Regular working hours Languages
English, GermanJob location
Münster, Germany
Tech stack
Bash
Cloud Computing
DevOps
Python
Node.js
Prometheus
Google Cloud Platform
Grafana
GIT
Kubernetes
Information Technology
Dynatrace
Go
Job description
- Du bist für die Einführung und Weiterentwicklung von SRE-/DevOps-Praktiken verantwortlich und berätst Entwicklungsteams auf dem Weg zu stabilen, produktionsreifen Services.
- Du stellst die Systemstabilität durch Observability, Monitoring, Alerting und Kapazitätsbetrachtungen sicher, z. B. mit Prometheus, Grafana oder Dynatrace.
- Du unterstützt den zuverlässigen Betrieb cloudnativer Anwendungen auf Kubernetes, insbesondere im Umfeld von Google Cloud Platform und Google Kubernetes Engine.
- Du analysierst Störungen im 2nd-/3rd-Level-Support, unterstützt die Incident Response und etablierst gemeinsam mit dem Team blameless Post-Mortem-Analysen, um systematisch aus Incidents zu lernen und nachhaltige Verbesserungen abzuleiten.
- Du arbeitest mit dem Team an der Optimierung von Betriebsprozessen, Runbooks, Automatisierungen und Standards zur Reduktion von Toil sowie zur Steigerung von Verfügbarkeit und Kundenzufriedenheit.
- Du berücksichtigst betriebliche Security- und Compliance-Anforderungen im Rahmen von Production Readiness, Zugriffen, Runbooks und Incident-Prozessen.
Requirements
- Du hast ein abgeschlossenes Studium der Informatik sowie mehrjährige einschlägige Berufserfahrung oder eine vergleichbare Qualifikation.
- Du besitzt praktische Erfahrung im stabilen Betrieb, in der Skalierung und in der Fehleranalyse produktionskritischer Anwendungen.
- Du bringst fundierte Kenntnisse in SRE-/DevOps-Methoden, Observability, Monitoring, Incident Response, SLIs, SLOs, Error Budgets und Toil Reduction mit und hast Erfahrung in der Zusammenarbeit mit agilen Entwicklungsteams.
- Du hast praktische Erfahrung mit Google Cloud Platform und Google Kubernetes Engine oder bringst fundierte Erfahrung mit Kubernetes in produktionskritischen Cloud-Umgebungen mit.
- Du verfügst über Kenntnisse in Automatisierung, Infrastructure as Code und Script- oder Programmiersprachen wie Bash, Python, Go, Node.js oder vergleichbaren Technologien sowie über Erfahrung mit Git.
- Du kannst Entwicklungsteams methodisch und technisch beraten, komplexe Zusammenhänge verständlich erklären und auch in kritischen Situationen strukturiert handeln.
- Du verstehst SRE nicht nur als Tooling- oder Betriebsrolle, sondern als Ansatz, um Entwicklungsteams zu befähigen und Services nachhaltig zuverlässiger zu machen.
- Du verfügst über verhandlungssichere Deutschkenntnisse mindestens auf C1-Niveau und gute Englischkenntnisse mindestens auf B2-Niveau.
- Du zeichnest dich durch Teamfähigkeit, analytisches Denken, Kommunikationsstärke, Eigeninitiative und eine selbständige Arbeitsweise aus.
About the company
Atruvia AG ist der Digitalisierungspartner in der Genossenschaftlichen FinanzGruppe. Das Unternehmen vereint jahrzehntelanges Expertenwissen in Banking und Informationstechnologie. Die speziell auf Banken zugeschnittenen IT-Lösungen und Leistungen reichen vom Rechenzentrumsbetrieb über das Atruvia Bankverfahren bis hin zur App-Entwicklung. Dabei nutzt das Unternehmen zukunftsweisende Technologien wie Smart Data und schreibt Prozessoptimierung und Regulatorik groß.