Site Reliability Engineer - Kubernetes / Cloud / DevOps
Workwise GmbH
Hamburg, Germany
4 days ago
Role details
Contract type
Permanent contract Employment type
Full-time (> 32 hours) Working hours
Shift work Languages
GermanJob location
Hamburg, Germany
Tech stack
Proxmox
Bash
Cloud Computing
Continuous Integration
Dynamic Host Configuration Protocol
Linux
DevOps
Distributed Systems
DNS
Virtual Private Networks (VPN)
Python
Octopus Deploy
OpenStack
Quick EMUlator (QEMU)
Ansible
Prometheus
Wide Area Networks
Data Logging
Saltstack
Grafana
Gitlab-ci
Script Language
Kubernetes
Terraform
Docker
ELK
Go
Job description
- Du pflegst Monitoring-, Logging- und Alerting-Lösungen (z. B. Prometheus, Grafana, Loki) zur proaktiven Erkennung von Problemen im Schichtbetrieb und wirkst bei der Lösung komplexer Issues in verteilten Systemen mit
- Du führst Fehlersuchen in Netzwerken (LAN/WAN/VPN, DNS, DHCP) und Speichersystemen (File/Object/Block) durch und stellst hochverfügbare Services auf Linux und Kubernetes (Helm-Charts) bereit
- Du baust Infrastructure-as-Code auf und pflegst Automatisierung und Playbooks mit Ansible, Terraform, GitLab CI/CD, Argo CD sowie Skriptsprachen wie Bash, Python und Go
- Du arbeitest mit Entwicklungsteams zusammen, um Prozesse und Deployments zu verbessern und neue Services und Applikationen reibungslos in unsere Cloud- und Kubernetes-Umgebung zu integrieren
- Du gewährleistest einen stabilen und sicheren Plattformbetrieb, inklusive End-to-End-Incident-Management von der ersten Analyse über die Lösung bis hin zur Nachbearbeitung im Rahmen des Problem-Managements, * Attraktive Arbeitsbedingungen: Du profitierst von einem hybriden Arbeitsmodell und flexiblen Schichtarbeitszeiten
- Moderne Arbeitsumgebung: An einigen Standorten erwartet dich eine bezuschusste Kantine und verschiedene kostenfreie Getränke sowie moderne Büroflächen mit sehr guter Verkehrsanbindung
- Vielfältige Mitarbeitervorteile: Du erhältst diverse Mitarbeiterrabatte für Aktivitäten und Produkte
- Gemeinschaft und Events: Freue dich auf Mitarbeiterevents wie Sommer- und Winterfeiern sowie Workshops
- Weiterbildung und Entwicklung: Zahlreiche Weiterbildungs- und Entwicklungsmöglichkeiten stehen dir zur Verfügung
- Gesundheitsförderung: Verschiedene Gesundheitsangebote, wie Sport- und Gesundheitskurse, unterstützen dein Wohlbefinden
Requirements
- Du bist bereit, in einem 24 × 7-Schichtmodell zu arbeiten (Nacht-, Wochenend- und Feiertagsdienste) und bringst ein starkes Problem-Lösungs- und Troubleshooting-Mindset mit
- Du hast mehrjährige Erfahrung als Site Reliability Engineer oder in einer verwandten Rolle (Linux-Systemadministrator, Platform Engineer, DevOps/Infrastructure Engineer, Full-Stack-Developer)
- Du verfügst über fundierte Kenntnisse in Automatisierungstools (z. B. Ansible, SaltStack), Monitoring- und Observability-Tools (Prometheus, Grafana, Loki) sowie Logging- und Alerting-Lösungen (ELK-Stack)
- Du hast Erfahrung mit virtualisierten Umgebungen (QEMU/KVM, OpenStack, Proxmox), Cloud-Storage-Technologien (File, Object, Block) und bist sicher im Umgang mit Docker & Kubernetes
- Du besitzt sehr gute Kenntnisse in mindestens einer Programmiersprache oder Skriptsprache (Go, Python, Bash) für Automatisierungs- und Monitoring-Aufgaben
- Du hast Erfahrung im Code-Management (Merge-Conflicts, Feature-Branches, Merge-Requests, CI/CD), was von Vorteil ist
About the company
Wir sind davon überzeugt: Eine Organisation ist immer nur so gut wie das Team, das hinter ihr steht. Mehr als die Hälfte aller mittelständischen Unternehmen sieht die größte Gefahr für den eigenen Erfolg im Fehlen geeigneten Personals. Unsere Mission ist es daher, Organisationen unkompliziert mit den passenden Mitarbeiter:innen zu verbinden, damit sie sich besser auf ihre eigentlichen Aufgaben und Ziele konzentrieren können. Dazu brauchen wir auch selbst ein starkes Team. Und dafür suchen wir dich.