SRE / DevOps: Infrastructure Transformation

iVentureGroup GmbH
Hamburg, Germany
4 days ago

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
5 years minimum
Working hours
Shift work
Languages
German

Tech stack

Amazon Web Services Microsoft Azure Bash Shell Cloud Computing Configuration Management Computer Literacy Continuous Integration Data Centers Linux DevOps Github Networking Hardware
+20 more
Python (Programming Language) Linux Servers Octopus Deploy Reliability Engineering Ansible Prometheus Software Engineering Data Logging Google Cloud Cloud Platform System Grafana Infrastructure as Code (IaC) Gitlab-ci Kubernetes Information Technology Hashicorp Terraform Webhooks Docker Jenkins

Job description

Werde Teil unseres Teams und bringe deine Expertise in Site Reliability Engineering (SRE) und IT-Transformation ein, um unsere Plattformen weiterzuentwickeln und innovative Lösungen für unsere Kunden und internen Teams bereitzustellen. Hier erwarten dich spannende Herausforderungen, neueste Technologien und ein starkes Team, das Wert auf Zusammenarbeit, Automatisierung und kontinuierliche Verbesserung legt., + Entwicklung und Implementierung von Infrastructure-as-Code (IaC)-Lösungen (z. B. Terraform, Ansible).

  • Automatisierung wiederkehrender Aufgaben wie Deployments, Skalierung und Fehlerbehebung.
  • Aufbau und Pflege von CI/CD-Pipelines zur schnellen und sicheren Softwarebereitstellung.
  • Transformation klassischer Linux Systeme in Kubernetes:
  • Migration von klassischen Linux-Servern zu Kubernetes Umgebungen
  • Begleitung der Softwareentwicklungsteams bei der Nutzung von Kubernetes für deren Workloads
  • Automatisierung der Netzwerkkomponenten im On Premise Datacenter
  • Sichere Verwaltung von Secrets:
  • Entwicklung und Einführung eines Secret Management Systems (z.B. Hashicorp Vault)
  • Anbindung kritischer Komponenten der IT Infrastructure
  • Einfacher aber sicherer Zugang für Applikationen und Personen zu Zugangsdaten
  • Fehlermanagement & Selbstheilungssysteme:
  • Implementierung automatisierter Recovery-Mechanismen zur Minimierung von Systemausfällen.
  • Entwicklung von Proaktiv-Monitoring-Lösungen zur frühzeitigen Problemidentifikation.
  • Einsatz von Event-Driven Automation (z. B. Lambda-Funktionen, Webhooks) zur autonomen Reaktion auf Anomalien.
  • Optimierung der Infrastruktur:
  • Automatisierte Skalierung von Cloud- und On-Premise-Systemen basierend auf Lastprognosen.
  • Sicherstellen der Einhaltung von Sicherheitsrichtlinien durch Compliance as Code.
  • Ressourcenoptimierung durch automatisierte Kapazitätsplanung.
  • Incident Response & Troubleshooting:
  • Entwicklung von Runbooks und Playbooks für automatisiertes Incident Management.
  • Nutzung von AIOps zur Analyse von Logs und Metriken zur Fehlerfrüherkennung.
  • Zusammenarbeit mit Entwicklern und Operations-Teams zur schnellen Problembehebung durch Automatisierung., * Unbefristetes Arbeitsverhältnis
  • Flexible Arbeitszeiten und mobiles Arbeiten
  • Individuelle Weiterbildungsmöglichkeiten
  • Bezuschussung für eine Mitgliedschaft bei Urban-Sports-Club(M oder L)
  • 3x wöchentliches Sportangebot mit einem Fitnesstrainer
  • Regelmäßige Team-Events für ein starkes Miteinander
  • Nutze unser JobRad-Leasing-Modell und fahre dein Wunschfahrrad dienstlich sowie privat
  • Möglichkeit in Abstimmung mit dem Team zeitweise remote aus dem Ausland zu arbeiten
  • Bezuschussung des 63-Euro-Tickets (“Deutschlandticket”)

Requirements

  • Gute Deutschkenntnisse auf mindestens B2-Niveau in Wort und Schrift
  • Mindestens 5 Jahre Berufserfahrung in der Site Reliability Engineering, DevOps oder Softwareentwicklung mit Fokus Automation & Configuration Management
  • Diese Rolle erfordert eine Präsenz an zwei Tagen pro Woche in unserem Hamburger Büro für Teammeetings. Wir unterstützen flexible Arbeitsmodelle, während wir gleichzeitig eine effektive Zusammenarbeit im Team sicherstellen.
  • Fundierte Kenntnisse in Infrastructure as Code (IaC) und Konfigurationsmanagement (z. B. Terraform, Ansible).
  • Sicherer Umgang mit CI/CD-Pipelines und Automatisierungstools (z. B. Jenkins, GitHub Actions, GitLab CI, ArgoCD).
  • Erfahrung mit Monitoring- und Logging-Lösungen (z. B. Prometheus, Grafana).
  • Kenntnisse in Container-Technologien & Orchestrierung (z. B. Kubernetes, Docker).
  • Erfahrung mit Cloud-Plattformen (AWS, Azure, Google Cloud).
  • Gute Programmier- und Scripting-Kenntnisse (z.B. Python, Bash).
  • Problemlösungsorientierte Arbeitsweise und Teamfähigkeit.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on jobs.iventuregroup.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:47 min

Exploring career opportunities and recruitment open positions

Kurt Eder · LIVE

52 sec

Running persistent Linux environments directly on Windows

Ben Breard Ben Breard · WWC 2025

2:07 min

Inspecting default bridge architectures and custom Docker networks

Oliver Seitz Oliver Seitz · WWC 2025

6:36 min

Funding open source through GitHub Accelerator and Sponsors

Stormy Peters · WWC 2023

2:27 min

Structuring agile and interdisciplinary engineering teams

Oliver Zimmert · LIVE

3:55 min

Demonstrating .NET installation on Debian and Azure Linux

Silvano Coriani Silvano Coriani · Europe 2026 Virtual

Videos

See all

Related articles

See all