Site Reliability Engineer - Kubernetes / Cloud / DevOps
IONOS SE
Berlin, Germany
2 days ago
Role details
Contract type
Permanent contract Employment type
Full-time (> 32 hours) Working hours
Shift work Languages
GermanJob location
Berlin, Germany
Tech stack
Proxmox
Bash
Cloud Computing
Continuous Integration
Linux
DevOps
Python
Octopus Deploy
OpenStack
Quick EMUlator (QEMU)
Ansible
Prometheus
Data Logging
Saltstack
Grafana
Gitlab-ci
Script Language
Kubernetes
Terraform
Docker
ELK
Go
Job description
- Du pflegst Monitoring-, Logging- und Alerting-Lösungen (z. B. Prometheus, Grafana, Loki) zur proaktiven Erkennung von Problemen im Schichtbetrieb und wirkst bei der Lösung komplexer Issues in verteilten Systemen mit
- Du führst Fehlersuchen in Netzwerken (LAN/WAN/VPN, DNS, DHCP) und Speichersystemen (File/Object/Block) durch und stellst hochverfügbare Services auf Linux und Kubernetes (Helm-Charts) bereit
- Du baust Infrastructure-as-Code auf und pflegst Automatisierung und Playbooks mit Ansible, Terraform, GitLab CI/CD, Argo CD sowie Skriptsprachen wie Bash, Python und Go
- Du arbeitest mit Entwicklungsteams zusammen, um Prozesse und Deployments zu verbessern und neue Services und Applikationen reibungslos in unsere Cloud- und Kubernetes-Umgebung zu integrieren
- Du gewährleistest einen stabilen und sicheren Plattformbetrieb, inklusive End-to-End-Incident-Management von der ersten Analyse über die Lösung bis hin zur Nachbearbeitung im Rahmen des Problem-Managements
Requirements
- Du bist bereit, in einem 24 × 7-Schichtmodell zu arbeiten (Nacht-, Wochenend- und Feiertagsdienste) und bringst ein starkes Problem-Lösungs- und Troubleshooting-Mindset mit
- Du hast mehrjährige Erfahrung als Site Reliability Engineer oder in einer verwandten Rolle (Linux-Systemadministrator, Platform Engineer, DevOps/Infrastructure Engineer, Full-Stack-Developer)
- Du verfügst über fundierte Kenntnisse in Automatisierungstools (z. B. Ansible, SaltStack), Monitoring- und Observability-Tools (Prometheus, Grafana, Loki) sowie Logging- und Alerting-Lösungen (ELK-Stack)
- Du hast Erfahrung mit virtualisierten Umgebungen (QEMU/KVM, OpenStack, Proxmox), Cloud-Storage-Technologien (File, Object, Block) und bist sicher im Umgang mit Docker & Kubernetes
- Du besitzt sehr gute Kenntnisse in mindestens einer Programmiersprache oder Skriptsprache (Go, Python, Bash) für Automatisierungs- und Monitoring-Aufgaben
- Du hast Erfahrung im Code-Management (Merge-Conflicts, Feature-Branches, Merge-Requests, CI/CD), was von Vorteil ist
Unser Jobangebot Site Reliability Engineer - Kubernetes / Cloud / DevOps (m/w/d) klingt vielversprechend?
About the company
Über IONOS SE
Wir sind Europas führende Plattform für Cloud Services und Hosting-Dienstleistungen. Wir begleiten erfolgreich unsere Kund:innen bei ihrer Unternehmensentwicklung. Für unseren Unternehmenserfolg sind über 4000 Mitarbeitende in mehreren Ländern weltweit tätig, um die Anforderungen und Wünsche unserer 8,5 Millionen Kund:innen zu erfüllen.
Wir sind eine Marke der United Internet AG, einem börsennotierten Unternehmen mit rund 10.200 Mitarbeitenden.
Wir fördern die Entwicklung unserer Mitarbeitenden und deren unterschiedliche Talente, Interessen und Sprachen.
Was bieten wir dir?
* Attraktive Arbeitsbedingungen: Du profitierst von einem hybriden Arbeitsmodell und flexiblen Schichtarbeitszeiten
* Moderne Arbeitsumgebung: An einigen Standorten erwartet dich eine bezuschusste Kantine und verschiedene kostenfreie Getränke sowie moderne Büroflächen mit sehr guter Verkehrsanbindung
* Vielfältige Mitarbeitervorteile: Du erhältst diverse Mitarbeiterrabatte für Aktivitäten und Produkte
* Gemeinschaft und Events: Freue dich auf Mitarbeiterevents wie Sommer- und Winterfeiern sowie Workshops
* Weiterbildung und Entwicklung: Zahlreiche Weiterbildungs- und Entwicklungsmöglichkeiten stehen dir zur Verfügung
* Gesundheitsförderung: Verschiedene Gesundheitsangebote, wie Sport- und Gesundheitskurse, unterstützen dein Wohlbefinden