Lebenslauf Studio

Lebenslauf Muster Site Reliability Engineer/in

Vorlage, Beispiel und Formulierungen

Site Reliability Engineer/innen (SRE) sorgen mit einem Software-Engineering-Ansatz für die Zuverlässigkeit, Verfügbarkeit und Skalierbarkeit produktionskritischer Systeme: Sie definieren Service Level Objectives (SLOs) und Error Budgets, bauen Observability-Systeme (Prometheus, Grafana) auf, automatisieren wiederkehrende Betriebsaufgaben und verantworten Incident-Response mit blameless Post-Mortems. Es gibt keine Ausbildungsordnung – typische Wege führen aus der Softwareentwicklung oder der Systemadministration in die Rolle, oft ergänzt durch Cloud-/Kubernetes-Zertifizierungen. Eng verwandt mit DevOps Engineer/in, aber stärker auf Zuverlässigkeits-Metriken statt breiter Pipeline-Verantwortung fokussiert. Gehalt: je nach Quelle stark unterschiedlich, grob 45.000 bis über 100.000 Euro brutto/Jahr.

Zuletzt aktualisiert am

Maria Beispiel
Site Reliability Engineer/in
0170 1234567maria.beispiel@mail.de50667 Kölngeb. 14.03.1992

Profil

Site Reliability Engineer mit mehrjähriger Erfahrung aus der Softwareentwicklung, heute verantwortlich für Verfügbarkeit, Skalierung und Zuverlässigkeit unternehmenskritischer Cloud-Services. Definiert und überwacht Service Level Objectives (SLOs) und Error Budgets, baut Observability-Stacks auf und automatisiert wiederkehrende Betriebsaufgaben ('Toil') per Python/Go. Verantwortet Incident-Response und strukturierte, blameless Post-Mortems. Bringt Software-Engineering-Disziplin (Code-Reviews, automatisierte Tests) in den Betrieb ein.

Berufserfahrung

03/2023 - heute
Site Reliability Engineer
Musterfirma Cloud GmbH, SaaS-Unternehmen
  • Definition und Monitoring von SLOs/SLIs für rund 20 produktionskritische Microservices
  • Aufbau eines Error-Budget-Frameworks zur Priorisierung zwischen Feature-Tempo und Stabilität
  • Betrieb und Skalierung von Kubernetes-Clustern (GKE) inkl. Auto-Scaling und Canary-Deployments
  • Aufbau eines Observability-Stacks mit Prometheus, Grafana und Distributed Tracing
  • Leitung des Incident-Response-Prozesses inkl. blameless Post-Mortems
07/2019 - 02/2023
Backend-Entwickler (Schwerpunkt Skalierung)
Musterfirma Software GmbH, Scale-up
  • Entwicklung und Betrieb produktionskritischer Backend-Services in Go/Python
  • Einführung erster automatisierter Health-Checks und Alerting-Regeln
  • Enge Zusammenarbeit mit dem Infrastruktur-Team bei Lastspitzen und Kapazitätsplanung

Ausbildung

10/2015 - 09/2019
Bachelor Informatik
Musterhochschule
  • Schwerpunkt Verteilte Systeme und Softwaretechnik
  • Abschlussarbeit zu Fehlertoleranz in verteilten Systemen
2022
Zertifizierung Google Cloud Professional Cloud DevOps Engineer
Google Cloud, berufsbegleitend
  • Vertiefung SRE-Praktiken, SLO-Design und Observability auf GCP
2023
Zertifizierung Certified Kubernetes Administrator (CKA)
Linux Foundation/CNCF, berufsbegleitend
  • Vertiefung Kubernetes-Cluster-Betrieb und Troubleshooting in Produktionsumgebungen

Kenntnisse

Kubernetes (Betrieb, Troubleshooting)Sehr gut
Prometheus & Grafana (Observability)Sehr gut
Python / Go (Automatisierung)Gut
SLO-/SLI-Design & Error-Budget-ManagementSehr gut
Incident-Response & Root-Cause-AnalyseSehr gut
Terraform / Infrastructure-as-CodeGut
Google Cloud Platform (GKE, Cloud Monitoring)Gut
Linux-SysteminternaGut

Sprachen

DeutschMuttersprache
EnglischSehr gut (C1, internationale Incident-Calls und Dokumentation)
Dieses Muster jetzt ausfüllen

Lebenslauf-Editor: Site Reliability Engineer/in

Vorbefüllt mit dem Muster oben. Überschreibe die Felder mit deinen eigenen Daten, die Vorschau aktualisiert sich sofort.

Download-Optionen unten am Editor

Live-Vorschau in A4
Maria Beispiel
Site Reliability Engineer/in
0170 1234567maria.beispiel@mail.de50667 Kölngeb. 14.03.1992

Profil

Site Reliability Engineer mit mehrjähriger Erfahrung aus der Softwareentwicklung, heute verantwortlich für Verfügbarkeit, Skalierung und Zuverlässigkeit unternehmenskritischer Cloud-Services. Definiert und überwacht Service Level Objectives (SLOs) und Error Budgets, baut Observability-Stacks auf und automatisiert wiederkehrende Betriebsaufgaben ('Toil') per Python/Go. Verantwortet Incident-Response und strukturierte, blameless Post-Mortems. Bringt Software-Engineering-Disziplin (Code-Reviews, automatisierte Tests) in den Betrieb ein.

Berufserfahrung

03/2023 - heute
Site Reliability Engineer
Musterfirma Cloud GmbH, SaaS-Unternehmen
  • Definition und Monitoring von SLOs/SLIs für rund 20 produktionskritische Microservices
  • Aufbau eines Error-Budget-Frameworks zur Priorisierung zwischen Feature-Tempo und Stabilität
  • Betrieb und Skalierung von Kubernetes-Clustern (GKE) inkl. Auto-Scaling und Canary-Deployments
  • Aufbau eines Observability-Stacks mit Prometheus, Grafana und Distributed Tracing
  • Leitung des Incident-Response-Prozesses inkl. blameless Post-Mortems
07/2019 - 02/2023
Backend-Entwickler (Schwerpunkt Skalierung)
Musterfirma Software GmbH, Scale-up
  • Entwicklung und Betrieb produktionskritischer Backend-Services in Go/Python
  • Einführung erster automatisierter Health-Checks und Alerting-Regeln
  • Enge Zusammenarbeit mit dem Infrastruktur-Team bei Lastspitzen und Kapazitätsplanung

Ausbildung

10/2015 - 09/2019
Bachelor Informatik
Musterhochschule
  • Schwerpunkt Verteilte Systeme und Softwaretechnik
  • Abschlussarbeit zu Fehlertoleranz in verteilten Systemen
2022
Zertifizierung Google Cloud Professional Cloud DevOps Engineer
Google Cloud, berufsbegleitend
  • Vertiefung SRE-Praktiken, SLO-Design und Observability auf GCP
2023
Zertifizierung Certified Kubernetes Administrator (CKA)
Linux Foundation/CNCF, berufsbegleitend
  • Vertiefung Kubernetes-Cluster-Betrieb und Troubleshooting in Produktionsumgebungen

Kenntnisse

Kubernetes (Betrieb, Troubleshooting)Sehr gut
Prometheus & Grafana (Observability)Sehr gut
Python / Go (Automatisierung)Gut
SLO-/SLI-Design & Error-Budget-ManagementSehr gut
Incident-Response & Root-Cause-AnalyseSehr gut
Terraform / Infrastructure-as-CodeGut
Google Cloud Platform (GKE, Cloud Monitoring)Gut
Linux-SysteminternaGut

Sprachen

DeutschMuttersprache
EnglischSehr gut (C1, internationale Incident-Calls und Dokumentation)

Kostenlos

PDF mit MUSTER-Wasserzeichen über das ganze Blatt, sofort herunterladen.

Ohne Wasserzeichen: 9,90 €

Einmaliger Kauf, sofortiger Download und Zustellung per E-Mail, keine Anmeldung.

An diese Adresse schicken wir das fertige PDF und die Rechnung. Sie muss nicht die Adresse deines Zahlungskontos sein.

Lebenslauf Beispiel Site Reliability Engineer/in zum Kopieren

Profil

Site Reliability Engineer mit mehrjähriger Erfahrung aus der Softwareentwicklung, heute verantwortlich für Verfügbarkeit, Skalierung und Zuverlässigkeit unternehmenskritischer Cloud-Services. Definiert und überwacht Service Level Objectives (SLOs) und Error Budgets, baut Observability-Stacks auf und automatisiert wiederkehrende Betriebsaufgaben ('Toil') per Python/Go. Verantwortet Incident-Response und strukturierte, blameless Post-Mortems. Bringt Software-Engineering-Disziplin (Code-Reviews, automatisierte Tests) in den Betrieb ein.

Berufserfahrung

03/2023 - heute

Site Reliability Engineer

Musterfirma Cloud GmbH, SaaS-Unternehmen

  • Definition und Monitoring von SLOs/SLIs für rund 20 produktionskritische Microservices
  • Aufbau eines Error-Budget-Frameworks zur Priorisierung zwischen Feature-Tempo und Stabilität
  • Betrieb und Skalierung von Kubernetes-Clustern (GKE) inkl. Auto-Scaling und Canary-Deployments
  • Aufbau eines Observability-Stacks mit Prometheus, Grafana und Distributed Tracing
  • Leitung des Incident-Response-Prozesses inkl. blameless Post-Mortems

07/2019 - 02/2023

Backend-Entwickler (Schwerpunkt Skalierung)

Musterfirma Software GmbH, Scale-up

  • Entwicklung und Betrieb produktionskritischer Backend-Services in Go/Python
  • Einführung erster automatisierter Health-Checks und Alerting-Regeln
  • Enge Zusammenarbeit mit dem Infrastruktur-Team bei Lastspitzen und Kapazitätsplanung

Werdegang

10/2015 - 09/2019

Bachelor Informatik

Musterhochschule

2022

Zertifizierung Google Cloud Professional Cloud DevOps Engineer

Google Cloud, berufsbegleitend

2023

Zertifizierung Certified Kubernetes Administrator (CKA)

Linux Foundation/CNCF, berufsbegleitend

Kenntnisse

  • Kubernetes (Betrieb, Troubleshooting)Sehr gut
  • Prometheus & Grafana (Observability)Sehr gut
  • Python / Go (Automatisierung)Gut
  • SLO-/SLI-Design & Error-Budget-ManagementSehr gut
  • Incident-Response & Root-Cause-AnalyseSehr gut
  • Terraform / Infrastructure-as-CodeGut
  • Google Cloud Platform (GKE, Cloud Monitoring)Gut
  • Linux-SysteminternaGut

Sprachen

  • DeutschMuttersprache
  • EnglischSehr gut (C1, internationale Incident-Calls und Dokumentation)

Tätigkeiten im Lebenslauf formulieren: Site Reliability Engineer/in

Zuverlässigkeit & SLOs

  • Definition und Monitoring von Service Level Objectives (SLOs) und Error Budgets für produktionskritische Services
  • Priorisierung zwischen Feature-Entwicklung und Stabilität auf Basis von Error-Budget-Verbrauch

Observability & Monitoring

  • Aufbau von Monitoring-, Logging- und Tracing-Stacks (Prometheus, Grafana, ELK-Stack, Distributed Tracing)
  • Entwicklung von Dashboards und Alerting-Regeln zur frühzeitigen Fehlererkennung

Incident-Response & Post-Mortems

  • Leitung/Mitwirkung im Bereitschaftsdienst (On-Call) für produktionskritische Systeme
  • Strukturierte, blameless Post-Mortem-Analysen zur nachhaltigen Fehlerbehebung

Automatisierung & Skalierung

  • Automatisierung wiederkehrender Betriebsaufgaben ('Toil') per Python/Go-Scripting
  • Betrieb und Skalierung containerisierter Infrastruktur (Kubernetes) inkl. Auto-Scaling

Software-Engineering-Praxis im Betrieb

  • Code-Reviews und automatisierte Tests für Infrastruktur- und Automatisierungscode
  • Enge Zusammenarbeit mit Entwicklungsteams bei Architekturentscheidungen mit Verfügbarkeitsrelevanz

Welche Kenntnisse gehören in den Lebenslauf als Site Reliability Engineer/in?

Fachliche Kenntnisse zeigen sofort die Praxiserfahrung, Zertifikate belegen sie formal, Soft Skills ergänzen sie. Alle drei gehören in den Lebenslauf, aber getrennt und konkret benannt.

Hard Skills

  • Kubernetes-Orchestrierung
  • Cloud-Plattformen (AWS, GCP, Azure)
  • Observability/Monitoring (Prometheus, Grafana, ELK-Stack, Distributed Tracing)
  • Programmierkenntnisse für Automatisierung (Python, Go)
  • Infrastructure-as-Code (Terraform, Ansible)
  • SLI-/SLO-/SLA-Design und Error-Budget-Management
  • Incident-Response und Root-Cause-Analyse
  • Chaos-Engineering-Grundlagen
  • Linux-Systeminterna

Zertifikate

  • Google Cloud Professional Cloud DevOps Engineer
  • AWS Certified SysOps Administrator
  • Certified Kubernetes Administrator (CKA)
  • Certified Kubernetes Application Developer (CKAD)
  • Certified Kubernetes Security Specialist (CKS)
  • HashiCorp Terraform Associate

Soft Skills

  • Ruhe und strukturiertes Handeln unter Incident-Druck
  • Kommunikation zwischen Entwicklungs- und Betriebsteams
  • Priorisierung zwischen Feature-Tempo und Stabilität
  • Bereitschaft zu On-Call/Bereitschaftsdienst
  • Kontinuierliche Lernbereitschaft (schnelllebiges Tool-Ökosystem)
  • Datengetriebenes, analytisches Denken

Werdegang und Gehalt als Site Reliability Engineer/in im Überblick

Wege in die RolleEs gibt keine Ausbildungsordnung für Site Reliability Engineer/in. Das Konzept wurde bei Google (Ben Treynor Sloss, ab 2003) geprägt: 'SRE ist, was passiert, wenn man eine Softwareentwicklerin bittet, ein Ops-Team aufzubauen.' Daraus ergeben sich zwei gleichrangige Hauptwege plus ein wachsender dritter und ein ergänzender vierter Weg. (1) Aus der Softwareentwicklung heraus (bei Google historisch der größere Anteil, 50-60 %): Softwareentwickler/innen mit Interesse an Systemdesign und Produktionsverantwortung wechseln in SRE-Rollen (verwandter bestehender Beruf: Softwareentwickler/in, Slug softwareentwickler). (2) Aus der Systemadministration/dem IT-Betrieb heraus, mit vertieften Programmierkenntnissen (Python, Go) – erfahrene Systemadministrator/innen gelten laut Google als gute Kandidat/innen, wenn sie bereit sind, wiederkehrende manuelle Aufgaben ('Toil') zu automatisieren statt zu wiederholen (verwandter bestehender Beruf: Systemadministrator/in, Slug systemadministrator). (3) Direkt über ein Informatik-/Softwaretechnik-Studium in eine SRE-Einstiegsposition, zunehmend verbreitet bei großen Tech-Arbeitgebern (SAP, Cisco, Okta), meist ergänzt um Werkstudierendentätigkeit im Infrastruktur-/Plattform-Umfeld. (4) Ergänzend, kein eigenständiger Erstzugang: Cloud- und Kubernetes-Zertifizierungen (Google Cloud Professional Cloud DevOps Engineer, AWS Certified SysOps Administrator, CKA/CKAD/CKS) sowie das Google-SRE-Buch als branchenweiter Referenzstandard. Google selbst stellt zwischen beiden Haupttracks keinen praktischen Leistungsunterschied fest – anders als bei DevOps Engineer/in ist der Zugang über Softwareentwicklung beim SRE-Konzept historisch und strukturell stärker gewichtet.
GehaltsspanneJe nach Quelle sehr unterschiedlich – bewusst nicht gemittelt. Grobe Bandbreite über alle vier Quellen: StepStone (kleine Stichprobe, 13 Stellenanzeigen) Median 62.000 EUR, gehalt.de Median 64.500 EUR, Glassdoor (168 Gehaltsangaben) Median 82.500 EUR mit Spanne 57.000–113.000 EUR nach Erfahrung, talent.com (mit Pooling-Vorbehalt) Median nur 45.760 EUR. Insgesamt grob 45.000 EUR im unteren Bereich bis über 110.000 EUR im oberen Perzentil bei erfahrenen SREs.

Was verdient man als Site Reliability Engineer/in? Die Quellen im Vergleich

Gehaltsportale kommen für denselben Beruf zu deutlich unterschiedlichen Werten, weil sie unterschiedlich erheben. Wir stellen sie deshalb nebeneinander, statt einen Durchschnitt zu bilden.

Die Quellen liegen 36.740 € auseinander. Diese Differenz ist kein Fehler, sondern Folge unterschiedlicher Erhebungsmethoden und Stichproben. Nutze die Werte als Spanne, nicht als Punktwert, und prüfe im Gespräch, worauf sich eine genannte Zahl bezieht.

Alle Angaben Bruttojahresgehalt, abgerufen am 12. August 2026.

Dos & Don'ts für den Site Reliability Engineer/in-Lebenslauf

Do

  • Konkrete SLO-/Error-Budget-Verantwortung nennen (z. B. "Verantwortung für 99,9%-SLO bei 15 Services") statt nur "Zuverlässigkeit sichergestellt"
  • Observability-Stack mit konkreten Tools benennen (Prometheus, Grafana, Distributed Tracing)
  • Herkunft klar zeigen (aus Softwareentwicklung oder Systemadministration) und daraus abgeleitete SRE-Praxis belegen
  • Incident-/On-Call-Erfahrung mit messbaren Ergebnissen belegen (z. B. reduzierte MTTR, weniger Wiederholungsvorfälle)
  • Zertifikate mit Jahr und ausstellender Stelle angeben

Don't

  • Nicht nur "SRE-Mindset" oder "Zuverlässigkeitsdenken" ohne konkrete SLOs/Tools nennen
  • SRE nicht unreflektiert mit DevOps Engineer/in gleichsetzen, wenn tatsächlich SLO-/Error-Budget-Verantwortung getragen wurde
  • Keine sicherheitsrelevanten Interna (Cluster-Namen, interne Dashboards, Zugangsdaten) im Lebenslauf offenlegen
  • Keine veralteten Zertifizierungen ohne Einordnung auflisten
  • Nicht den Eindruck erwecken, SRE sei ein geschützter Ausbildungsberuf mit festem Curriculum

Häufige Fragen zum Lebenslauf als Site Reliability Engineer/in

Was macht ein/e Site Reliability Engineer/in genau?

Site Reliability Engineer/innen sorgen mit einem Software-Engineering-Ansatz für die Zuverlässigkeit, Verfügbarkeit und Skalierbarkeit produktionskritischer Systeme. Sie definieren Service Level Objectives (SLOs), überwachen Error Budgets, bauen Observability-Systeme auf und automatisieren wiederkehrende Betriebsaufgaben.

Was ist der Unterschied zwischen Site Reliability Engineer/in und DevOps Engineer/in?

DevOps Engineer/in ist breiter auf CI/CD-Pipelines und die Zusammenarbeit zwischen Entwicklung und Betrieb ausgerichtet. Site Reliability Engineer/in ist spezialisierter auf Systemzuverlässigkeit mit klar definierten SLOs/SLIs und einem Error-Budget-Konzept, das Innovationstempo gegen Stabilität abwägt – SRE gilt als eine konkrete, messbare Umsetzung der DevOps-Philosophie.

Braucht man ein Informatikstudium, um Site Reliability Engineer/in zu werden?

Nicht zwingend, aber häufig. Laut Google, wo das Konzept entstand, kommen SREs etwa je zur Hälfte aus der klassischen Softwareentwicklung (oft mit Informatik-/Softwaretechnik-Studium) und aus der Systemadministration mit vertieften Programmierkenntnissen. Beide Wege gelten als gleichwertig.

Wie viel verdient ein/e Site Reliability Engineer/in in Deutschland?

Die Angaben schwanken stark je nach Quelle: StepStone nennt einen Median von rund 62.000 Euro brutto/Jahr (kleine Stichprobe von 13 Stellenanzeigen), gehalt.de rund 64.500 Euro, Glassdoor rund 82.500 Euro (Basis 168 Gehaltsangaben) mit einer Spanne von rund 57.000 bis 113.000 Euro je nach Erfahrung.

Was ist ein "Error Budget"?

Ein Error Budget ist das anhand des Service Level Objective festgelegte, tolerierte Ausfallkontingent eines Systems (z. B. 0,1% Downtime pro Monat bei einem 99,9%-SLO). Solange das Budget nicht aufgebraucht ist, kann das Team schneller neue Features ausliefern; ist es aufgebraucht, hat Stabilität Vorrang vor neuen Releases.

Quellen

  1. Reliability Engineer » Gehalt & Beruf, gehalt.de, abgerufen am 2026-08-12
  2. Reliability Engineer Gehälter in Deutschland 2026, StepStone, abgerufen am 2026-08-12
  3. Gehalt: Site Reliability Engineer (Juli 2026), Glassdoor, abgerufen am 2026-08-12
  4. Site Reliability Engineer Gehalt in Deutschland, talent.com, abgerufen am 2026-08-12
  5. Google SRE Book - Introduction, Google SRE, abgerufen am 2026-08-12
  6. SRE vs DevOps: Understanding the Key Differences, PagerDuty, abgerufen am 2026-08-12
  7. Site Reliability Engineer vs DevOps: 9 Major Differences, KnowledgeHut, abgerufen am 2026-08-12
  8. Site Reliability Engineer - SCI (f/m/d), SAP Jobs, abgerufen am 2026-08-12

Der Content wurde mit Hilfe von KI erstellt, vor allem in der Recherche und Vorformulierung. Prüfung und Abnahme durch unsere Redaktion.

Verwandte Rollen und Berufe in IT & Technik

Herausgegeben von Lebenslauf Studio

Zuletzt aktualisiert am 12.08.2026