en
Jobs

Our industry specialists will listen to your aspirations and share your story with Germany’s most prestigious organisations. Together, let’s write the next chapter of your career.

See all jobs
About Robert Walters Germany

For us, recruitment is more than just a job. We understand that behind every opportunity is the chance to make a difference to people’s lives.

Learn more

Work for us

Our people are the difference. Hear stories from our people to learn more about a career at Robert Walters Germany.

Learn more

Senior Site Reliability Engineer (m/w/d)

Save job

Du möchtest moderne Cloud-Infrastrukturen nicht nur betreiben, sondern aktiv stabiler, skalierbarer und resilienter machen? Für ein international ausgerichtetes Technologieunternehmen im Finanzumfeld suchen wir einen Senior Site Reliability Engineer (m/w/d), der Verantwortung für die Zuverlässigkeit und Weiterentwicklung einer hochverfügbaren Plattform übernimmt.

Unser Kunde ist ein international tätiges Technologieunternehmen aus dem Finanz- und Banking-Umfeld mit Hauptsitz in Berlin und mehreren hundert Mitarbeitenden in Europa.

Das Unternehmen entwickelt eine moderne, skalierbare Technologieplattform, über die Geschäftskunden digitale Finanz- und Banking-Services anbieten können. Dabei treffen Finanztechnologie, Cloud Engineering, Softwareentwicklung und moderne Plattformarchitekturen aufeinander.

Das technische Umfeld ist geprägt von einem hohen Automatisierungsgrad, modernen Cloud-Technologien und hohen Anforderungen an Verfügbarkeit, Sicherheit und Resilienz.

Die Position kann überwiegend remote aus Deutschland ausgeübt werden. Regelmäßige Präsenz in Berlin ist vorgesehen.

Detaillierte Arbeitsbezeichnung und Arbeitsinhalte

Als Senior Site Reliability Engineer (m/w/d) übernimmst Du eine zentrale Rolle bei der Weiterentwicklung und Stabilisierung der technischen Plattform.

Deine Aufgaben:

  • Entwicklung und Weiterentwicklung von Monitoring- und Alerting-Standards
  • Aufbau von Frameworks und Standards für SLIs, SLOs und SLAs
  • Weiterentwicklung von Incident-Response- und Reliability-Prozessen
  • Entwicklung von Maßnahmen zur Verbesserung von Resilienz, Stabilität und Verfügbarkeit
  • Automatisierung operativer Prozesse und Entwicklung entsprechender Tools
  • Aufbau und Weiterentwicklung von Monitoring-Dashboards
  • Analyse von Kapazitätsanforderungen und frühzeitige Identifikation möglicher Engpässe
  • Entwicklung von Architekturen mit automatisierten Failover-Mechanismen
  • Reduzierung des Blast Radius einzelner Fehler und Ausfälle
  • Durchführung bzw. Unterstützung von Chaos Engineering zur gezielten Prüfung der Systemresilienz
  • Zerlegung komplexer Architekturziele in konkrete, umsetzbare Arbeitspakete
  • Bewertung und Auswahl geeigneter Third-Party-Tools
  • Technische Betreuung von Tools und Plattformkomponenten als zentraler Ansprechpartner
  • Planung und sichere Umsetzung größerer Plattformänderungen
  • Enge Zusammenarbeit mit Development-, Platform- und Infrastructure-Teams
  • Teilnahme an einer 24/7-On-Call-Rotation

Warum diese Rolle besonders spannend ist

  • Hoher technischer Gestaltungsspielraum: Du entwickelst Standards und Strukturen aktiv mit, anstatt lediglich bestehende Systeme zu verwalten.
  • Modernes Cloud-Umfeld: Du arbeitest mit modernen Technologien rund um Cloud, Plattform Engineering, Automation und Observability.
  • Business-kritische Systeme: Deine Arbeit hat direkten Einfluss auf die Stabilität und Verfügbarkeit einer wichtigen digitalen Finanzplattform.
  • SRE statt klassischem Betrieb: Der Fokus liegt auf Automatisierung, Resilienz, Skalierbarkeit und kontinuierlicher Verbesserung.
  • Internationale Zusammenarbeit: Du arbeitest in einem internationalen, englischsprachigen Technologieumfeld.
  • Entwicklungsmöglichkeiten: Deine fachliche und persönliche Weiterentwicklung wird durch ein transparentes Entwicklungsmodell und ein jährliches Weiterbildungsbudget unterstützt.
  • Remote Work: Du kannst flexibel aus Deutschland arbeiten und regelmäßig aus dem Ausland tätig sein.

Dein Profil: Das bringst Du mit

  • Mindestens 6 Jahre Berufserfahrung in SRE, DevOps oder Software Engineering
  • Studium in Informatik, Software Engineering, Information Technology oder eine vergleichbare praktische Qualifikation
  • Sehr gute Erfahrung mit Cloud- und Plattformtechnologien
  • Programmier- bzw. Scripting-Erfahrung mit Python, Ruby, Java oder Go
  • Erfahrung mit Service Discovery und/oder Service Mesh
  • Fundiertes Verständnis von Microservices und deren Kommunikation
  • Erfahrung mit Capacity Planning und Performance-Optimierung
  • Kenntnisse im Aufbau hochverfügbarer und resilienter Systeme
  • Erfahrung mit Failover- und Disaster-Recovery-Konzepten
  • Idealerweise Erfahrung mit Chaos Engineering, z. B. Chaos Mesh oder Gremlin
  • Erfahrung in der Entwicklung und Umsetzung von Monitoring- und Alerting-Konzepten
  • Verständnis von SLI, SLO und SLA
  • Erfahrung mit Incident Response und Reliability Engineering
  • Bereitschaft zur Teilnahme an einer 24/7-Rufbereitschaft
  • Verständnis für die besonderen Anforderungen und Rahmenbedingungen des Finanzsektors
  • Sehr gute Englischkenntnisse in Wort und Schrift
  • Deutschkenntnisse sind von Vorteil
  • Strukturierte, eigenständige und Hands-on-Arbeitsweise
  • Hohe Eigenverantwortung und ausgeprägtes Ownership
  • Agile Mentalität sowie Bereitschaft, bestehende Prozesse kontinuierlich zu hinterfragen und zu verbessern

Benefits

Remote Work aus Deutschland mit regelmäßiger Präsenz in Berlin

  • Möglichkeit, bis zu 12 Wochen pro Jahr aus dem Ausland zu arbeiten
  • Homeoffice-Budget
  • 1.000 € Learning & Development Budget pro Jahr
  • Individuelle Weiterentwicklung und transparentes Karriere-/Growth Framework
  • Wettbewerbsfähiges Gehalt plus variable Vergütung
  • Monatlicher Zuschuss für Verpflegung
  • Zuschuss zum Deutschlandticket
  • 28 Urlaubstage, mit zusätzlichem Urlaubsanspruch bei längerer Betriebszugehörigkeit ab dem 2. Jahr
  • Internationales und modernes Arbeitsumfeld
  • Hoher technischer Gestaltungsspielraum
  • Zusammenarbeit mit erfahrenen Engineering- und Platform-Teams
  • Fokus auf kontinuierliche fachliche und persönliche Weiterentwicklung

Was kommt als nächstes:

Wenn du Lust hast, Teil eines engagierten Teams zu werden und gemeinsam spannende Projekte voranzubringen, dann freue ich mich auf deine Bewerbung! Komme bei Fragen gerne auf mich zu – egal ob per Telefon, per Mail oder bei LinkedIn:

Jil Nübel
Consultant
Robert Walters - Recruitment
Gorch-Fock-Wall 1a, 20354 Hamburg
Tel: +49 40 377 07 3981
Mobile: +49 (0)151 2107 8555
E-mail: Jil.Nuebel@RobertWalters.com
Web: www.robertwalters.de

Contract Type: Perm

Specialism: Information Technology

Focus: DevOps Engineer

Industry: Banking

Salary: €75,000 - €100,000 per annum

Workplace Type: Hybrid

Experience Level: Associate

Location: Berlin

Job Reference: P49AMJ-B81FDB45

Date posted: 20 August 2026

Consultant: Jil Nübel