Site Reliability Engineer

Markant Gruppe
Offenburg, Germany
2 days ago
Apply on www.adzuna.de
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Shift work
Languages
English, German
Job source

Tech stack

Linux Disaster Recovery Distributed Systems Prometheus Data Logging Grafana Kubernetes Information Technology

Job description

  • Du stellst die Zuverlässigkeit, Verfügbarkeit und Leistungsfähigkeit der Markant Developer Plattform sicher.
  • Du entwickelst und betreibst Observability-Lösungen für Monitoring, Logging, Tracing und Alerting.
  • Du analysierst Betriebsstörungen, identifizierst deren Ursachen und leitest nachhaltige Massnahmen zur Verbesserung der Stabilität ein.
  • Du definierst und etablierst Kennzahlen zur Bewertung von Verfügbarkeit, Performance und Servicequalität und treibst deren kontinuierliche Verbesserung voran.
  • Du konzipierst Massnahmen zur Erhöhung der Resilienz, Skalierbarkeit und Ausfallsicherheit unserer Entwicklungsplattform.
  • Du planst, koordinierst und führst Disaster-Recovery-Tests durch und bewertest deren Ergebnisse.
  • Du unterstützt und befähigst unsere Entwicklungsteams bei der Umsetzung von Reliability- und Observability-Anforderungen.
  • Du analysierst und löst komplexe bereichsübergreifende Herausforderungen.
  • Du pflegst kontinuierlich Betriebsdokumentationen, Standards und Runbooks.
  • Du wirkst an der Rufbereitschaft für die Entwicklungsplattform mit., * Arbeitsplatzumgebung am Puls der Zeit (inkl. höhenverstellbarer Schreibtische)
  • Corporate Benefits Partner
  • E-Ladestationen
  • Einladendes, arbeitgebergefördertes Betriebsrestaurant
  • Gleitzeitmodell zur flexiblen Arbeitszeitgestaltung
  • Hansefit
  • Mitarbeiter Events
  • Mobiles Arbeiten

Requirements

  • Du verfügst über eine abgeschlossene technische Ausbildung, ein Studium im IT-Bereich oder eine vergleichbare Qualifikation.
  • Du bringst fundierte Kenntnisse in mindestens einem der folgenden Bereiche mit: Hyperscaler, Kubernetes, Linux sowie Monitoring- und Observability-Lösungen.
  • Du hast Erfahrung im Betrieb und in der Optimierung komplexer IT-Plattformen und verteilter Systeme.
  • Du kennst dich mit Monitoring-, Logging- und Alerting-Lösungen wie Grafana, Prometheus, Loki, Mimir, Tempo oder vergleichbaren Technologien aus.
  • Du verfügst über Kenntnisse in den Bereichen Automatisierung, Infrastructure as Code sowie modernen Betriebs- und Deploymentverfahren.
  • Du hast Erfahrung in der Analyse und Behebung komplexer Störungen sowie in der nachhaltigen Ursachenanalyse.
  • Du zeichnest dich durch ein ausgeprägtes analytisches Denkvermögen und starke Problemlösungsfähigkeiten aus.
  • Du arbeitest eigenverantwortlich, selbstständig und bist gleichzeitig ein echter Teamplayer.
  • Du überzeugst durch eine kunden- und lösungsorientierte Arbeitsweise.
  • Du verfügst über sehr gute Deutsch- und gute Englischkenntnisse.

About the company

Die Markant Gruppe ist eines der grössten Dienstleistungsunternehmen in Europa für Handels- und Industriepartner aus dem Food- und Nonfood-Bereich. Unser breites Lösungsportfolio reicht von der Vereinfachung von Datenströmen und Zahlungsabwicklungen über exklusive Finanz- und Versicherungs-Services bis hin zu modernsten Marktforschungstools. Dahinter steckt die Idee: Kunden im operativen Tagesgeschäft zu entlasten, damit sie sich auf ihr Kerngeschäft konzentrieren können. Was noch dahintersteckt: Das Engagement von über 1000 Mitarbeitern, die mit fundiertem Know-how für exzellente Leistungen sorgen. Eine einzigartige Chance auch für Sie, um sich beruflich bei uns einzubringen und gemeinsam mit uns zu wachsen.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.adzuna.de
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

10:40 min

Visualizing Prometheus open metrics using custom Grafana dashboards

Stijn Polfliet · LIVE

2:47 min

Exploring career opportunities and recruitment open positions

Kurt Eder · LIVE

52 sec

Running persistent Linux environments directly on Windows

Ben Breard Ben Breard · World Congress 2025

1:05 min

Measuring system availability utilizing Prometheus and straightforward PromQL

Alexander Schwartz Alexander Schwartz · World Congress 2025

13:07 min

Configuring application observability with Micrometer and Prometheus

Aleksandr Kalikov · LIVE

4:47 min

Automating frontend performance metrics with Google Lighthouse

Miki Lombardi · JS Congress

Videos

See all

Related articles

See all