JobRaahGet matched free

Jobs

Site Reliability Engineer (w/m/d)

IONOS DE · Revaler Straße 28-31, 10245 Berlin · Germany · On-site

Posted Aug 21, 2026

Apply with JobRaah

Sign up free: we match you to jobs like this, tailor your application and fill the form. 2 free applications every day.

Über IONOS Bei IONOS verwalten wir nicht nur Server, wir prägen mit unseren Lösungen die digitale Zukunft für über 6,2 Millionen Kundinnen und Kunden weltweit. Als Europas führender Hosting-Anbieter und Pionier für unabhängige Cloud-Lösungen bauen wir eine Infrastruktur der nächsten Generation: von souveränen Cloud-Architekturen und hochperformanten GPU-Clustern bis hin zu integrierten KI-Automatisierungstools. Was uns antreibt: Digitale Entscheidungsfreiheit für Europa und echter Impact für kleine und mittlere Unternehmen (KMU) sowie Großunternehmen. Wir arbeiten in agilen Teams, setzen auf transparente Strukturen und glauben daran, dass Exzellenz und Innovation nur mit echtem Teamgeist entstehen. Bereit für Deinen nächsten Schritt? Werde ein Teil von IONOS und wachse mit uns. Als Site Reliability Engineer (SRE) in unserem Application Hosting Team bildest du das technische Rückgrat unserer Produktplattform für Managed Nextcloud, Nextcloud Workspace, IONOS GPT sowie weitere Web Services, die wir auf unserer Kubernetes Plattform betreiben. Gemeinsam mit erfahrenen Kolleg*innen entwirfst du neue Dienste und Produkte, die auch bei höchster Last performant und ausfallsicher bleiben. Aufgabenbereich Dein Haupteinsatzbereich ist die Weiterentwicklung der Infrastruktur/Plattform unserer Produkte, sowie die Integration neuer Produkte/Webdienste in unsere Kubernetes - und Cloud - Infrastruktur. Du bist verantwortlich für den stabilen und sicheren Betrieb unserer Produktplattform. Deine Expertise ist gefragt, wenn es um tiefgreifende Analysen und die Optimierung unserer primär containerisierten und Kubernetes-basierten Anwensungsinfrastruktur geht. Du lebst Automatisierung. Mit Tools wie Terraform, Gitlab CI/CD und ArgoCD provisionierst und verwaltest du unsere gesamte Infrastruktur deklarativ und reproduzierbar. Du analysierst und behebst komplexe Probleme in einer verteilten Systemlandschaft und arbeitest an der stetigen Verbesserung unserer Plattform. Du entwickelst und pflegst unsere Monitoring-, Logging- und Alerting-Lösung (z. B. mit Prometheus, Grafana, ELK-Stack), um proaktiv Engpässe und Fehlerquellen zu identifizieren. Qualifikationen Du hast mehrjährige Erfahrung als Site Reliability Engineer oder in einer verwandten Rolle (Linux System Administrator, Platform Engineer, DevOps Engineer, Full Stack Developer) in einem Linux und Kubernetes Umfeld. Sehr gute Kenntnisse und mehrjährige Erfahrung in der Verwendung des Linux Betriebssystems, Container-Technologien sowie speziell in Kubernetes. Du hast Erfahrung mit Infrastructure as Code (vorzugsweise Terraform), CI/CD-Pipelines (z. B. GitLab CI/CD oder GitHub Actions) und in der Nutzung und Verwendung von Helm Charts. Du kannst sicher in mindestens einer Programmier- oder Skriptsprache (z. B. Go, Python, Bash) entwickeln, um Automatisierungs- und Monitoring-Aufgaben zu lösen und hast eventuell schon erste Erfahrungen im Bau von Operatoren gesammelt. Erfahrung mit…