Zum Inhalt springen
Technik & Ingenieurwesen

Site Reliability Engineer

Site Reliability Engineers sorgen dafür, dass große Online-Dienste zuverlässig und schnell laufen, und lösen Betriebsprobleme mit Mitteln der Softwareentwicklung.

13 offene Stellen zu diesem Beruf im aktuellen Bestand.

Gehalt

Was man als Site Reliability Engineer verdient

Monats- und Jahresbrutto nach Erfahrungsstufe, bundesweit
Erfahrung Von Median Bis Jahresbrutto Verhältnis
Berufseinstieg 4.300 € 5.000 € 5.800 € 60.000 €
Mit Berufserfahrung 5.200 € 6.100 € 7.100 € 73.200 €
Mit langjähriger Erfahrung 6.300 € 7.400 € 8.800 € 88.800 €

Ohne Tarifbindung; die Gehälter gehören zu den höheren in der IT, weil die Rolle meist mit Senior-Erfahrung besetzt wird und in international ausgerichteten Unternehmen angesiedelt ist. Rufbereitschaftsvergütung und Aktienprogramme sind nicht eingerechnet.

Die Werte sind Orientierungswerte und keine amtliche Statistik. Sie sind aus öffentlich verfügbaren Erhebungen, Tarifwerken und Stellenanzeigen abgeleitet und auf volle Euro gerundet. Im Einzelfall entscheiden Betrieb, Tarifbindung, Region, Qualifikation und Verhandlung – die Abweichung nach oben wie nach unten kann erheblich sein.

Das Jahresbrutto ist das 12-fache des Monatswertes. Urlaubs- und Weihnachtsgeld sind nicht enthalten, weil sie sich von Branche zu Branche unterscheiden.

Gehalt nach Bundesland

Das Berufsbild

Site Reliability Engineering ist ein Ansatz, der den Betrieb von Software als Ingenieursaufgabe behandelt: Statt Server von Hand zu pflegen und Störungen einzeln zu beheben, schreiben SREs Software, die Systeme überwacht, skaliert und im Fehlerfall selbst reagiert. In deutschen Unternehmen findet sich die Rolle vor allem dort, wo viele Nutzer rund um die Uhr auf einen Dienst angewiesen sind – bei Onlinebanken, Zahlungsdienstleistern, Plattformen im Gesundheitswesen, Cloud- und Rechenzentrumsanbietern und großen Onlinehändlern.

Kern der Arbeit sind messbare Ziele für die Zuverlässigkeit. Ein SRE-Team legt mit den Produktteams fest, welche Verfügbarkeit und Antwortzeit ein Dienst erreichen muss, misst diese Werte laufend und entscheidet daraus, ob neue Funktionen ausgerollt werden dürfen oder zuerst Stabilität Vorrang hat. Dazu gehören Observability – Metriken, Logs und Traces –, Kapazitätsplanung, Lasttests, das Automatisieren wiederkehrender Betriebsarbeit und die Arbeit an Datenbanken, Netzwerken und Container-Plattformen. Wenn doch etwas ausfällt, leitet der SRE in der Bereitschaft die Störungsbehebung, und danach folgt eine schuldfreie Nachbetrachtung, aus der dauerhafte Verbesserungen entstehen.

In diesem Bestand kommen die Anzeigen von einer Gesundheitsplattform, einem Cloud- und Rechenzentrumsanbieter und einer Onlinebank; ausgeschrieben sind überwiegend Senior-Stellen mit Schwerpunkten wie Datenbanken oder Observability, Teilzeit gibt es keine. Das ist typisch: SRE ist selten eine Einstiegsrolle, sondern wird mit Erfahrung aus Systemadministration, DevOps oder Backend-Entwicklung besetzt. Arbeitssprache ist in diesen Unternehmen häufig Englisch.

Zur Stelle gehört fast immer eine Rufbereitschaft, meist im Wechsel im Team und mit gesonderter Vergütung. Die Abgrenzung zum DevOps Engineer ist fließend; SRE-Stellen legen den Schwerpunkt stärker auf den laufenden Betrieb, auf Zuverlässigkeitsziele und auf Störungsmanagement. Weiterentwicklung führt zum Staff- oder Principal-Engineer oder in die Leitung eines Plattform- oder Infrastrukturteams.

Aufgaben

  • Zuverlässigkeitsziele für Dienste definieren, messen und berichten
  • Monitoring, Alarmierung und Observability-Werkzeuge aufbauen und pflegen
  • Wiederkehrende Betriebsaufgaben durch Software automatisieren
  • Datenbanken, Container-Plattformen und Netzwerke betreiben und skalieren
  • Störungen in der Rufbereitschaft analysieren und beheben
  • Nachbetrachtungen von Störungen leiten und Verbesserungen umsetzen
  • Kapazitäten planen und Systeme mit Lasttests absichern

Voraussetzungen

  • Studium der Informatik oder vergleichbare Qualifikation mit mehrjähriger Berufserfahrung
  • Tiefe Kenntnisse in Linux, Netzwerken und verteilten Systemen
  • Programmiererfahrung, etwa in Go, Python oder Java
  • Erfahrung mit Kubernetes, Cloud-Plattformen und Infrastruktur als Code
  • Sicherheit mit Monitoring- und Observability-Werkzeugen
  • Bereitschaft zu Rufbereitschaft im Wechsel
  • Sehr gute Englischkenntnisse

Wo man arbeitet

  • Onlinebanken und Zahlungsdienstleister
  • Cloud- und Rechenzentrumsanbieter
  • Digitale Plattformen und Onlinehändler
  • Software- und Softwareplattformunternehmen
  • Telekommunikationsunternehmen

Der Weg in den Beruf

Einen formalen Ausbildungsweg gibt es nicht. Typisch ist ein Informatikstudium oder eine Ausbildung zum Fachinformatiker, gefolgt von mehreren Jahren in Systemadministration, DevOps oder Backend-Entwicklung. Cloud- und Kubernetes-Zertifizierungen sind verbreitet, entscheidend sind aber nachweisbare Erfahrungen mit dem Betrieb großer Systeme.

Offene Stellen als Site Reliability Engineer

In der Suche fortsetzen

Verwandte Berufe

Backend Engineer

Entwickelt die serverseitige Logik von Software – Schnittstellen, Datenbanken und Dienste, auf denen Apps und Plattformen laufen.

Offene Stellen
31
Monatsbrutto
3.900 – 9.000 €

DevOps Engineer

DevOps Engineers bauen und betreiben die Infrastruktur, auf der Software gebaut, getestet und ausgeliefert wird, und automatisieren den Weg vom Code bis zum laufenden System.

Offene Stellen
14
Monatsbrutto
4.050 – 8.200 €

jobs-jobs-jobs.de verwendet nur die Cookies, die für den Betrieb der Seite nötig sind. Kein Tracking, keine Werbenetzwerke, keine Auswertung Ihres Verhaltens. Einzelheiten stehen in der Datenschutzerklärung.

Datenschutz