Zum nächstmöglichen Zeitpunkt suchen wir Sie als Site Reliability Engineer für den Standort Berlin.
Ihr Aufgabenbereich
- Definition von SLOs auf Basis kundenseitiger SLAs und Errechnung der daraus resultierenden Fehlertoleranzen (Error Budgets)
-
Zusammenarbeit mit Software- und DevOps Engineers bei der Entwicklung neuer Designs und Architekturen für moderne Web-Anwendungen
-
Standardisierung und Automatisierung von Build-, Test- und Deployment-Prozessen unter Berücksichtigung höchster Qualitäts- und strenger Datenschutz-Anforderungen
-
Aufbau und Betrieb einer Continuous Integration Umgebung sowie Administration und Synchronisation der Container-Registries
-
Aufbau und Betrieb von virtuellen Netzwerkinfrastrukturen
-
Einführung und Weiterentwicklung sinnvoller SRE-Praktiken
-
Analyse und Lösung von Systemstörungen durch Recherche und sorgfältige Fehlerdokumentation
Ihr Profil
- Erfolgreich abgeschlossenes Studium der Informatik bzw. einer vergleichbaren Fachrichtung oder eine technische Ausbildung mit einschlägiger Berufspraxis in vergleichbarer Position
-
Erfahrungen im Cloud-Umfeld (z.B. AWS, MS AZURE) sowie im Betrieb von verteilten Netzwerk-Infrastrukturen
-
Erfahrungen mit Tools zum Monitoring, Debugging und zur Performance-Messung sowie Expertise im Umgang mit Containern und deren Orchestrierung
-
Sicherer Umgang mit regulären Ausdrücken, Scripting und dynamischen Programmiersprachen (zB. bash, Python, Ruby, Go)
-
Gute Kenntnisse mit verteilten Versionierungsystemen (zB. git, hg) sowie Erfahrung mit der SRE-Methodik & -Kultur
-
Systematische, zielorientierte und selbständige Arbeitsweise sowie Teamfähigkeit und gutes Kommunikationsvermögen
-
Bereitschaft zur Arbeit in Rufbereitschaft und Schichtbetrieb