JJobsSonar

Senior Site Reliability Engineer (m/f/d) AWS

Deutsche Telekom · Košice, Kosice, Slovakia

SRE / ReliabilityRemote

About this role

The Senior SRE for AWS is responsible for designing, implementing, and operating highly reliable, scalable, and secure cloud infrastructure on AWS. The role ensures the stability and performance of production systems by applying Site Reliability Engineering principles, automation, and Infrastructure as Code practices. The candidate will collaborate with architects and application engineers, automate operational processes, and contribute to documentation and best practices.

Skills & technologies

Must have

  • AWS
  • Terraform
  • CloudFormation
  • CI/CD
  • Python
  • Bash
  • ALB
  • ELB
  • WAF
  • S3
  • Route53
  • Serverless
  • APIs
  • High Availability
  • Disaster Recovery
  • Infrastructure as Code
  • Scrum
  • Agile

Read full description

About the job Deine Aufgabe Der Senior SRE für AWS ist verantwortlich für das Design, die Implementierung und den Betrieb hochzuverlässiger, skalierbarer und sicherer Cloud-Infrastruktur auf AWS. Die Rolle stellt die Stabilität und Performance von Produktionssystemen sicher, indem Site Reliability Engineering-Prinzipien, Automatisierung und Infrastructure as Code-Praktiken angewendet werden. Aufgaben Zusammenarbeit mit Architekten und Application Engineers, um sicherzustellen, dass Anwendungen wartbar und skalierbar sind und geeigneten Disaster Recovery- und High Availability-Strategien folgen Beiträge zu Handbüchern, Runbooks und Architektur-Design-Dokumenten, um konsistente Arbeitsmethoden und Transparenz zwischen Teams zu gewährleisten Entwicklung und Automatisierung von Standard Operating Procedures für gängige Fehlerszenarien und manuelle Betriebsaufgaben Arbeit in Scrum-Teams zusammen mit Architekten und Product Managern zur Unterstützung und Bereitstellung neuer Infrastrukturen und operativer Anforderungen Design, Verwaltung und Wartung von Tools zur Automatisierung manueller operativer Prozesse Aufbau und Wartung von Produktionssystemen auf AWS unter Verwendung von ALB, ELB, WAFs, S3, Serverless, APIs, Route53 usw. mit dem Einsatz von IaC (Terraform und CloudFormation) Fehlerbehebung bei Problemen, Einbeziehung der entsprechenden Ressourcen und Vorantreiben der Lösungsfindung mit Fokus auf Minimierung der Auswirkungen auf Kunden Nutzung fundierter Expertise zur Planung und Leitung der Bereitstellung von Cloud-Lösungen in Produktionsumgebungen unter Verwendung von CI/CD-Pipelines Erstellung praktischer Demonstrationen vorgeschlagener Lösungen und Präsentation dieser vor anderen Teammitgliedern Beiträge zur Entwicklung von Best Practices für Infrastructure as Code, Software-Build-Tools und Continuous Integration Arbeit und Zusammenarbeit mit multinationalen Teams in einem internationalen Umfeld Dein Profil Wir suchen einen Senior SRE für AWS mit umfangreicher praktischer Erfahrung im Design, der Implementierung und dem Betrieb hochzuverlässiger, skalierbarer und sicherer Cloud-Infrastruktur auf AWS unter Anwendung von Site Reliability Engineering-Prinzipien, Automatisierung und Infrastructure as Code-Praktiken. Muss-Kriterien Ausgeprägte praktische Erfahrung mit AWS Cloud Services, insbesondere ALB/ELB, WAF, S3, Route53, Serverless-Komponenten und API-Integrationen Fundierte Erfahrung im Design, Deployment und Betrieb von Cloud-nativer Infrastruktur in Produktionsumgebungen Praktische Erfahrung mit Infrastructure as Code, insbesondere mit Terraform und/oder CloudFormation Erfahrung im Aufbau und der Wartung von CI/CD-Pipelines für automatisierte Infrastruktur- und Anwendungs-Deployments Ausgeprägte Automatisierungs- und Scripting-Kenntnisse (z.B. Python, Bash oder ähnlich), um manuelle operative Arbeiten zu eliminieren Erfahrung im Design von High Availability-, Skalierbarkeits- und Disaster Recovery-Architekturen in Cloud-Umgebungen Ausgeprägte Troubleshooting- und Incident Management-Fähigkeiten mit der Fähigkeit, Ursachen schnell zu identifizieren und Service-Auswirkungen zu minimieren Erfahrung in der Erstellung und Pflege von Runbooks, operativer Dokumentation und Architekturdokumentation Erfahrung in der Arbeit in Agile/Scrum-Teams mit enger Zusammenarbeit mit Architekten, Engineers und Product Managern Erfahrung in der Implementierung und Förderung von DevOps Best Practices, einschließlich Infrastruktur-Automatisierung, Monitoring und kontinuierlicher Verbesserung Erfahrung im Aufbau und der Wartung von operativen Tools und Automatisierungs-Frameworks zur Unterstützung von Produktionssystemen Ausgeprägte Kommunikations- und Kollaborationsfähigkeiten, die effektive Arbeit in verteilten und internationalen Teams ermöglichen Proaktive und lösungsorientierte Denkweise Du fühlst dich wohl dabei, technische Lösungen gegenüber Kollegen und Stakeholdern zu demonstrieren und zu erklären Über uns Unsere Marke Deutsche Telekom IT Solutions Slovakia trat 2006 unter dem Namen T-Systems Slovakia in das Leben der Region Košice ein und ist seitdem untrennbar mit der Region verbunden, als wir eines der Gründungsmitglieder des Košice IT Valley wurden. Wir haben es geschafft, von Grund auf zum zweitgrößten Arbeitgeber im östlichen Teil des Landes mit mehr als 3900 Mitarbeitern zu wachsen. Unser Ziel ist es, proaktiv neue Wege zur Verbesserung zu finden und uns kontinuierlich in die Art von Unternehmen zu transformieren, das innovative Informations- und Kommunikationstechnologie-Dienstleistungen anbietet. Wir glauben an die Balance zwischen Arbeit und Privatleben. Ein attraktives und umfangreiches Work-Life-Balance-Portfolio garantiert dauerhafte Motivation für Mitarbeiter und damit eine bessere Lebensqualität, fördert das körperliche und geistige Wohlbefinden und trägt zu einem positiven Arbeitsumfeld bei. All dies mit dem Ziel, mehr Freiheit bei der Vereinbarkeit von Arbeit, Karrierewachstum, Privatleben und individuellem Lebensstil zu bieten. Deshalb bieten wir unseren Mitarbeitern über 25 verschiedene Benefits, um ihr persönliches und berufliches Leben in diesen Bereichen zu verbessern: Finanzielle Benefits Benefits mit Fokus auf Lernen und Entwicklung Benefits mit Fokus auf Gesundheit und Sport Benefits mit Fokus auf Familie und Work-Life-Balance Weitere Benefits Für mehr Informationen über unsere Benefits klicke auf Benefits Gehalt: Das endgültige Gehalt ist verhandelbar. Wir bieten ein Grundgehalt abhängig vom Senioritätslevel und der bisherigen Erfahrung des Kandidaten. Zusätzlich zum Grundgehalt bieten wir einen variablen Anteil und weitere finanzielle Benefits. Das Grundgehalt wird nicht niedriger als 2.200 € /brutto sein. Weitere Details Bitte beachte, dass unsere Remote-Work-Möglichkeit aufgrund der europäischen Steuergesetzgebung nur innerhalb der Slowakei verfügbar ist.
Ready to apply?Apply now

Similar SRE / Reliability jobs

All SRE / Reliability jobs

Site Reliability Engineer Sr

Dayforce · United States

SRE / ReliabilityRemoteEasy apply$80.5K/yr - $143.8K/yr2w ago

Senior SRE (Cloud)

Hazelcast · United Kingdom

SRE / ReliabilityRemoteEasy apply1mo ago