Staff Storage Reliability Engineer

United Internet AG
Karlsruhe, Germany
6 days ago
Apply on job-boards.eu.greenhouse.io
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Experience level
Expert
Experience required
5 years minimum
Working hours
Shift work

Tech stack

Cloud Computing Linux Ansible Ceph (Software) Cloud Platform System Docker

Job description

Derzeit liegen wir im zweistelligen Peta-Byte-Bereich, verteilt ĂŒber mehrere Standorte. Unsere Ceph-Plattform wĂ€chst schnell und ist ein kritischer Bestandteil unserer internen und öffentlichen Infrastruktur. Du wirst aktiv an der Weiterentwicklung mitwirken, unsere Produktionsumgebungen verbessern und betreuen und dafĂŒr sorgen, dass VerfĂŒgbarkeit, Performance und Sicherheit beim Skalieren erhalten bleiben.

Aufgabenbereich

Ceph-Deployment und -Management:

  • Ceph-Cluster bereitstellen, konfigurieren und betreiben - inklusive der Verwaltung von Storage-Pools, Placement-Groups und weiteren Kernkomponenten.

Performance-Optimierung:

  • Ceph fĂŒr optimale Leistung abstimmen, EngpĂ€sse beseitigen und eine effiziente Ressourcennutzung sicherstellen.

Automation:

  • Automatisierungs-Strategien fĂŒr Ceph-Deployments, Upgrades und Wartungsaufgaben entwickeln und umsetzen.

Fehlersuche und Problemlösung:

  • Komplexe technische Probleme im Zusammenhang mit Ceph-Storage diagnostizieren und beheben - hĂ€ufig in Zusammenarbeit mit anderen Teams.

Zusammenarbeit:

  • Eng mit Entwicklungsteams, System-Administratoren und anderen Stakeholdern kooperieren, um Ceph in verschiedene Systeme und Anwendungen zu integrieren.

Auf dem Laufenden bleiben:

  • Die neuesten Ceph-Entwicklungen, neuen Features und Best-Practices verfolgen.
  • In der Ceph-Community aktiv mitwirken und Wissen teilen., * Hybrides Arbeitsmodell.
  • Flexible Arbeitszeiten durch Vertrauensarbeitszeit.
  • An einigen Standorten eine bezuschusste Kantine und verschiedene kostenfreie GetrĂ€nke.
  • Moderne BĂŒroflĂ€chen mit sehr guter Verkehrsanbindung.
  • Diverse Mitarbeiterrabatte fĂŒr AktivitĂ€ten und Produkte.
  • Mitarbeiterevents wie Sommer- und Winterfeiern, sowie Workshops.
  • Zahlreiche Weiterbildungs- und Entwicklungsmöglichkeiten.
  • Verschiedene Gesundheitsangebote, wie Sport- und Gesundheitskurse.

Requirements

  • 5+ Jahre Erfahrung als Senior Linux Engineer oder Site Reliability Engineer; tiefes und breites VerstĂ€ndnis von Linux-Systemen und Netzwerken.
  • Fundierte Kenntnisse in Ceph-Architektur und -Administration.
  • Erfahrung mit Cloud-Storage-Technologien (File, Object, Block).
  • Praxis mit Automatisierungstools (z. B. Ansible) sowie Monitoring- und Observability-Lösungen.
  • Vertrautheit mit Cloud-Plattformen und Container-Technologien (z. B. Docker).
  • Hervorragende FĂ€higkeiten zur Fehlersuche und Problemlösung, starke Kommunikations- und KollaborationsfĂ€higkeiten.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on job-boards.eu.greenhouse.io
Prepare application

Good distractions

Loading talks and stories from around this role