Senior Site Reliability Engineer

d.velop AG
Gescher, Germany
about 1 month ago

Role details

Contract type
Permanent contract
Employment type
Part-time / full-time
Experience level
Expert
Working hours
Shift work
Job source

Tech stack

Application Programming Interfaces (APIs) Artificial Intelligence Software as a Service Databases Continuous Integration Data Security Shard (Database Architecture) DevOps PostgreSQL Backup and Restore Cloud Platform System Kubernetes
+1 more
Vertica

Job description

Datenintensive SaaS-Services zuverlässig zu betreiben, reicht Dir nicht: Du willst verstehen, wo operative Risiken entstehen, wo Skalierung fragil wird und wie Services nachhaltig beobachtbar, performant und betreibbar bleiben. In dieser Rolle machst Du unsere Plattformservices mit wachsendem Datenvolumen, steigender Nutzung und zunehmender Mandantenanzahl systematisch robuster und skalierbarer - von der Analyse operativer Schwachstellen bis zur praktischen Umsetzung konkreter Verbesserungen., * Du ßbernimmst operative Verantwortung fßr den Reifegrad datenintensiver SaaS-Services und bringst SRE-/DevOps-Praktiken wie SLOs/SLIs, Betriebsmetriken, Incident Learning, Runbooks und kontinuierliche Verbesserung in den Engineering-Alltag.

  • Du gestaltest Betrieb und Weiterentwicklung unserer zentralen Datenbanksysteme fĂźr wachsende Datenmengen, komplexe Query-Patterns und unterschiedliche Tenant-Profile - und denkst dabei Datenmodell, Datenzugriff, Deployment, Betriebskosten und Produktwirkung zusammen.
  • Du adressierst Skalierung proaktiv - mit Kapazitätsplanung, Performance-Tests, Tenant-Isolation und geeigneten Strategien wie Partitionierung oder Sharding, bevor Skalierungsgrenzen zu Kundenproblemen werden.
  • Du denkst Betriebsfähigkeit als Produkteigenschaft: Unsere Services sollen cloud-provider-agnostisch sowie in On-Premises- und kundennahen Umgebungen zuverlässig installierbar, diagnostizierbar und betreibbar sein - mit robusten Migrationen, Diagnosefähigkeit unter unterschiedlichen Betriebsbedingungen und Performance auf heterogener Infrastruktur.
  • Du verankerst Betriebswissen im Team, stärkst gemeinsame operative Verantwortung und unterstĂźtzt Tech Lead, Product Management und Engineering-Team als Sparringspartner bei Reliability-, Skalierungs- und Betriebsthemen.
  • Du nutzt AI und AIOps-Ansätze pragmatisch fĂźr bessere Operations - etwa fĂźr Analyse, Automatisierung, Dokumentation und das Erkennen wiederkehrender Muster - und bewertest AI-bezogene Betriebsanforderungen kritisch mit Blick auf Skalierung, Kosten, Observability, Sicherheit und Mandantentrennung.

Requirements

  • Du bringst seniorige Erfahrung im Betrieb produktiver SaaS- oder Plattformservices mit - inklusive echter Produktionsverantwortung und kontinuierlicher Verbesserung. Produktionsnahe Situationen wie Incidents, Stabilisierung, Betriebsverbesserungen oder On-Call-/Bereitschaftsmodelle sind Dir vertraut. Du wartest nicht auf Tickets, sondern erkennst operative Risiken eigenständig und Ăźbersetzt sie in umsetzbare Verbesserungsarbeit.
  • Du verstehst relationale und/oder analytische Datenbanksysteme im Betrieb und hast praktisch mit ihnen gearbeitet: Performance, Query-Verhalten, Migrationen, Datenwachstum, Monitoring, Backup/Restore, Recovery und Skalierungsgrenzen sind fĂźr Dich vertraute Themen - insbesondere PostgreSQL und ClickHouse sind relevant.
  • Du hast Erfahrung mit Skalierung in realen Produktionsumgebungen - bei wachsendem Datenvolumen, steigender Nutzung, Mandantenwachstum oder heterogenen Workloads - und bewertest dabei technische, wirtschaftliche und operative Auswirkungen im Zusammenspiel.
  • Du bringst praktische DevOps-/SRE-Erfahrung in produktionsnahen Umgebungen mit - von CI/CD, Infrastruktur und Kubernetes bis zu Cloud-Plattformen, Observability, Automatisierung und Reliability Engineering.
  • Du bist hands-on und strukturierst unscharfe operative Probleme eigenständig - von Analyse und Priorisierung bis zu Verbesserungen, die Du gemeinsam mit dem Team tragfähig umsetzen kannst. Dabei kannst Du mit dem Engineering-Team auf AugenhĂśhe Ăźber Architektur, APIs, Persistenz und Laufzeitverhalten datenintensiver Services sprechen.
  • Du arbeitest gerne hybrid und siehst regelmäßige Präsenz vor Ort als Teil wirksamer Zusammenarbeit, insbesondere fĂźr Sparring, operative Klärungen und gemeinsames Lernen im Team.

About the company

Diese Stelle wird an den folgenden Standorten der d.velop Gruppe angeboten

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on de.indeed.com

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

2:47 min

Exploring career opportunities and recruitment open positions

Kurt Eder ¡ LIVE

3:04 min

Database evolution and the funding behind vector databases

Erik Bamberg ¡ LIVE

2:17 min

Mapping the maturity roadmap for scaled devops adoption

Dominik Krichbaum Dominik Krichbaum ¡ World Congress 2026 Europe

1:06 min

Developer experience and project variety at scale

Alexandra Petri ¡ World Congress 2023

4:01 min

Managing application isolation via pluggable database models

Wei Hu Wei Hu ¡ World Congress 2022

3:18 min

Scaling global network engineering through DevOps culture

Stuart Clark ¡ LIVE

Videos

See all

Related articles

See all