Site Reliability Engineer (m/w/d)
Deloitte Stuttgart, Baden-Württemberg, Germany
Business Consulting and Services · 10,001+ employees
Applying here? Try the free cover letter tool — paste this posting and your résumé, no account needed.
About the role
You will ensure the stable, secure, and scalable operation of Kubernetes-based platforms while managing CI/CD pipelines and infrastructure automation. Additionally, you will optimize monitoring, logging, and observability solutions to maintain high availability and compliance for cloud services.
What they look for
Requirements
Candidates must have at least 4 years of experience in Site Reliability Engineering or platform operations with strong proficiency in Linux, Kubernetes, and automation scripting. A degree in Computer Science or a related field is required, along with excellent German and English language skills.
Benefits
Full description
Du willst im Bereich Sovereign Cloud die Verfügbarkeit, Stabilität und Sicherheit moderner Cloud-Plattformen aktiv mitgestalten? Unser Team betreibt hochverfügbare Plattformen mit höchsten Anforderungen an Sicherheit, Compliance und digitale Souveränität und sorgt so für resiliente Cloud-Services.
Standorte: Frankfurt (Main), Düsseldorf, Hamburg, Hannover, Leipzig, München und Stuttgart.
Dein Impact:
Als Site Reliability Engineer (m/w/d) stellst du den stabilen, sicheren und skalierbaren Betrieb Kubernetes-basierter Plattformen sicher – und schaffst die Grundlage für leistungsfähige, hochverfügbare und compliant IT-Services.
- Plattformbetrieb: Du betreibst und wartest Kubernetes-Plattformen, verwaltest Helm Charts und Repositories und unterstützt das Lifecycle Management von Clustern und Plattformkomponenten.
- Automatisierung & Deployment: Mit deinem Know-how betreust du CI/CD-Pipelines, entwickelst Infrastructure-as-Code sowie Automatisierungslösungen für Provisionierung, Health Checks, Compliance und Reporting.
- Monitoring & Observability: In deiner Rolle optimierst du Monitoring-Lösungen, entwickelst Alert Rules und Dashboards und sorgst für eine transparente Echtzeit- und Langzeitüberwachung.
- Logging & Analyse: Gemeinsam mit deinem Team betreibst und optimierst du Logging-Plattformen und stellst eine zuverlässige, sichere und skalierbare Verarbeitung sowie Analyse von Log-Daten sicher.
- Incident Management & Security: Durch die Analyse und Behebung komplexer Störungen, die Umsetzung von Sicherheitsrichtlinien sowie die Pflege von Runbooks und Dokumentationen gewährleistest du einen stabilen und regelkonformen Betrieb.
Dein Skillset:
- Abschluss in Informatik, Wirtschaftsinformatik oder einem vergleichbaren Fachgebiet, alternativ eine passende Ausbildung oder vergleichbare Qualifikation
- Erfahrung von mindestens 4 Jahren im Site Reliability Engineering, DevOps-Umfeld oder Plattformbetrieb sowie im Betrieb von Kubernetes-basierten Plattformen
- Kenntnisse in Linux, Kubernetes, Helm, Git-basierten Deployment-Workflows, CI/CD-Tools sowie in der Automatisierung mit Python, Go oder Bash und Infrastructure-as-Code
- Know-how in Monitoring-, Observability- und Logging-Lösungen, idealerweise mit Prometheus, OpenTelemetry, Grafana sowie Elasticsearch bzw. OpenSearch; relevante Zertifizierungen sind von Vorteil
- Deutsch und Englisch sehr gut in Wort und Schrift, Bereitschaft zur Rufbereitschaft sowie zur Sicherheitsüberprüfung Ü2
Deine Chance:
- Erweiterung deines Know-hows in einem technisch anspruchsvollen Umfeld mit modernen Cloud-, Kubernetes- und Observability-Technologien
- Sehr gute Rahmenbedingungen mit attraktiver Vergütung
- Attraktives Arbeitsumfeld mit Möglichkeit für mobiles Arbeiten
Bist du bereit? Mach mit uns den Unterschied!
Unser Recruiting-Team freut sich auf deine Bewerbungsunterlagen (CV sowie Abitur-, Hochschul- und Arbeitszeugnisse) über unser Online-Formular. Ein Anschreiben und ein Bewerbungsfoto sind bei uns nicht erforderlich.
Gleiche Chancen für alle: Wir freuen uns über Bewerbungen von Menschen, die so vielfältig sind wie wir – unabhängig von Alter, Behinderung, ethnischer Herkunft und Nationalität, Geschlecht, Religion, sexueller Orientierung oder sozialer Herkunft. Noch Fragen? Alle Infos zu unserem Bewerbungsprozess findest du in unseren Bewerbungs-FAQs.
Similar roles
-
Senior SRE Engineer
Jobgether France
-
Senior Site Reliability Engineer
ServiceTitan Bengaluru, Karnataka, India
-
Site Reliability Engineer - CTJ - Secret
Microsoft Reston, Virginia, United States · $85K–$184K/yr
-
Principal Data Systems Software Engineer - SRE - Top Secret Clearance Required
Oracle Herndon, Virginia, United States · $115K–$235K/yr
-
Senior Site Reliability Engineer
Oracle United States · $81K–$187K/yr
-
Senior Site Reliability Engineer (DevTools)
Visa Basingstoke, England, United Kingdom