JJobsSonar

Senior Systems, Platform and Reliability Engineer (m/w/d)

Instaffo · Hamburg, Hamburg, Germany

SRE / Reliability

About this role

The role involves designing, building, and operating a hybrid infrastructure consisting of on-premises servers, Proxmox VE clusters, VMs, containers, and AWS services. The engineer will ensure the stability, stability, and scalability of a growing VM environment and future Kubernetes platforms. Key responsibilities include implementing Infrastructure as Code and Configuration Management to automate tasks, managing patch and release management, and improving application reliability through monitoring, alerting, and incident response. The position also involves participating in on-call duties and collaborating closely with with software development, security, and product teams.

Skills & technologies

Must have

Nice to have

Read full description

Du bist interessiert an der Stelle als Senior Systems, Platform and Reliability Engineer (m/w/d) bei Gaia AG?

Auf Instaffo kannst du dich für diesen und weitere Jobs ohne großen Aufwand bewerben. Erstelle dein Profil in unter 2 Minuten und starte den Bewerbungsprozess mit nur wenigen Klicks.

Anforderungen

Bitte beachte, dass für diese Stelle eine Arbeitserlaubnis für Deutschland erforderlich ist.

Sprache: Deutsch - Fließend (C1), Englisch - Konversationssicher (B1-B2)

  • Mehrjährige Berufserfahrung in Systems Administration, Site Reliability Engineering, Platform Engineering oder DevOps
  • Fundierte Praxis mit Virtualisierung, idealerweise Proxmox VE, sowie Container-Technologien (Docker, Kubernetes von Vorteil)
  • Erfahrung mit Infrastructure as Code und Configuration-Management-Tools (z. B. Terraform, Ansible)
  • Kenntnisse in Netzwerktechnik über mehrere Standorte/Rechenzentren hinweg
  • Erfahrung mit AWS-Services im produktiven Einsatz
  • Praxis in Automatisierung, Monitoring und Incident-/On-Call-Prozessen
  • Selbstständige, strukturierte Arbeitsweise und hohes Verantwortungsbewusstsein für kritische Systeme
  • Fließende Deutsch- und Englischkenntnisse

Tätigkeiten

  • Design, Aufbau und Betrieb unserer hybriden Infrastruktur (On-Premises-Server, Proxmox-VE-Cluster, VMs, Container, Networking über mehrere Rechenzentren sowie ausgewählte AWS-Services)
  • Sicherstellung von Stabilität, Sicherheit und Skalierbarkeit einer wachsenden VM-Umgebung sowie zukünftiger Kubernetes-Plattformen
  • Umsetzung von Infrastructure as Code und Configuration Management zur Automatisierung wiederkehrender Betriebsaufgaben
  • Patch- und Release-Management sowie Weiterentwicklung der Virtualisierungsumgebung
  • Analyse und Verbesserung der Application Reliability, inkl. Monitoring, Alerting und Incident Response
  • Teilnahme an Rufbereitschaft (On-Call) sowie Mitwirkung an Disaster-Recovery-Planung
  • Entwicklung von Standards, Guidelines und Best Practices für Infrastruktur und Betrieb
  • Unterstützung der Entwicklungsteams bei Deployment-Workflows und Normalisierung von Deployment-Prozessen
  • Enge Zusammenarbeit mit Softwareentwicklung, Security und Produktteams

Über das Unternehmen

GAIA AG zählt zu den weltweit führenden Unternehmen im Bereich Digital Health. Wir arbeiten erfolgreich mit namhaften Industrieunternehmen, Krankenkassen, Ärzteorganisationen sowie führenden Universitäten in Europa, den USA und Asien zusammen und vereinen wissenschaftliche, technologische und therapeutische Kompetenz unter einem Dach. Mit Therapiesoftware wie deprexis® setzen wir den weltweiten Standard für Innovation und Evidenz.

Klicke auf "Bewerben" für Details zu den Benefits, dem Team und dem Bewerbungsprozess.
Ready to apply?Apply now

Similar SRE / Reliability jobs

All SRE / Reliability jobs