Back to search
Schwarz Digits Linkedin · Posted 1mo ago

Site Reliability Engineer - Cloud Infrastructure - STACKIT (m/w/d)

Germany

Linkedin
Continue to application Add your email once, then Caio opens the original posting.

Indexed description

Deine Aufgaben

  • Du förderst eine Kultur der Zuverlässigkeit, indem du Engineering-Teams dabei unterstützt, resiliente Services mit minimalem manuellem Aufwand (Toil) zu betreiben.
  • Du agierst als Mentor und Advisor, um die „Reliability-First“-Mentalität in den Entwicklungsteams zu verankern.
  • Du steuerst das ganzheitliche Vorfallsmanagement – von der akuten Krisenkoordination als Incident Commander bis zur nachhaltigen Fehleranalyse (RCA) zur kontinuierlichen Systemverbesserung.
  • Du standardisierst Operations-Prozesse und etablierst den Reliability Score, um die operative Exzellenz gemeinsam mit den Teams nachhaltig zu steigern.
  • Du implementierst Werkzeuge zur Messbarkeit und Steuerung von Service Level Objectives (SLOs)

Dein Profil

  • Du verfügst über ein ausgeprägtes „Reliability-First“-Mindset und verstehst die Balance zwischen Geschwindigkeit und Stabilität.
  • Du hast fundierte Erfahrung im Site Reliability Engineering (SRE) und kennst die Prinzipien von SLOs, Error Budgets und Toil-Management.
  • Du bist sicher in der Durchführung von Root Cause Analyses (RCA) und der Ableitung von Maßnahmen zur Fehlervermeidung.
  • Du besitzt gute Kenntnisse in der Entwicklung von Automatisierungsskripten oder internen Tools (z. B. Python, Go).
  • Du hast Freude an der Zusammenarbeit mit verschiedenen Stakeholdern in einer dezentralen, europäischen Organisation.
Free. 20 seconds. No password. See every match in this search.

Create a free Caio profile to unlock more results and save your role and location preferences.

Unlock free search
Want help applying to roles like this? Search Caio for free. If repetitive applications get heavy, Managed Job Search adds supervised execution for $99/month.
View Managed Job Search