Site Reliability Engineer (w/m/d)

None  •  IT & Software  •  Berlin, Germany

<div class="show-more-less-html__markup show-more-less-html__markup--clamp-after-5 relative overflow-hidden"> Aufgabenbereich<br/><br/><ul><li>Technischer Level‑2‑Support mit direktem Kundenkontakt.</li><li>Pflege von Monitoring‑, Logging‑ und Alerting‑Lösungen (z. B. Prometheus, Grafana, Loki) zur proaktiven Erkennung von Problemen im Schichtbetrieb und Mitwirkung bei der Lösung komplexer Issues in verteilten Systemen.</li><li>Fehlersuche in Netzwerken (LAN/WAN/VPN, DNS, DHCP) und Speichersystemen (File/Object/Block); Bereitstellung und Betrieb hochverfügbarer Services auf Linux und Kubernetes (Helm‑Charts).</li><li>Aufbau und Pflege von Infrastructure‑as‑Code, Automatisierung und Playbooks mit Ansible, Terraform, GitLab CI/CD, Argo CD sowie Skriptsprachen wie Bash, Python und Go.</li><li>Zusammenarbeit mit Entwicklungsteams zur Verbesserung von Prozessen und Deployments sowie zur reibungslosen Integration neuer Services und Applikationen in unsere Cloud‑ und Kubernetes‑Umgebung.</li><li>Gewährleistung eines stabilen und sicheren Plattformbetriebs, inklusive End‑to‑End‑Incident‑Management von der ersten Analyse über die Lösung bis hin zur Nachbearbeitung im Rahmen des Problem‑Managements.<br/><br/></li></ul>Qualifikationen<br/><br/><ul><li>Bereitschaft, in einem 24 × 7‑Schichtmodell zu arbeiten (Nacht‑, Wochenend‑ und Feiertagsdienste) und dabei ein starkes Problem‑Lösungs‑ und Troubleshooting‑Mindset mitzubringen.</li><li>Mehrjährige Erfahrung als Site Reliability Engineer oder in einer verwandten Rolle (Linux‑Systemadministrator, Platform Engineer, DevOps/Infrastructure Engineer, Full‑Stack‑Developer).</li><li>Fundierte Kenntnisse in Automatisierungstools (z. B. Ansible, SaltStack), Monitoring‑ und Observability‑Tools (Prometheus, Grafana, Loki) sowie Logging‑ und Alerting‑Lösungen (ELK‑Stack).</li><li>Erfahrung mit virtualisierten Umgebungen (QEMU/KVM, OpenStack, Proxmox), Cloud‑Storage‑Technologien (File, Object, Block) und sicherer Umgang mit Docker &amp; Kubernetes.</li><li>Sehr gute Kenntnisse in mindestens einer Programmiersprache oder Skriptsprache (Go, Python, Bash) für Automatisierungs‑ und Monitoring‑Aufgaben.</li><li>Erfahrung im Code‑Management (Merge‑Conflicts, Feature‑Branches, Merge‑Requests, CI/CD) ist von Vorteil.<br/><br/></li></ul><strong>Nice‑to‑have<br/><br/></strong><ul><li>Erfahrung mit RDMA, InfiniBand und RoCE‑Protokollen.</li><li>Tiefe Kenntnisse in Linux MD RAID (mdadm, sedadm) und LVM.</li><li>Expertise in Linux‑Performance‑Tuning und Netzwerk‑Stack‑Debugging (ethtool, perf, tcpdump, ibstat, ibtop).</li><li>Praxis mit S3, Ceph und software‑definierten Netzwerken.</li><li>Erfahrung mit etablierten Software‑Entwicklungspraktiken (Code‑Reviews, Build‑Prozesse, Packaging, Testing).<br/><br/></li></ul>Sprachkenntnisse: Fließend in Deutsch und Englisch (mindestens B2 nach dem CEFR‑Standard).<br/><br/>Standort: Berlin<br/><br/>Hinweis: Zum Ende des Bewerbungsprozesses müssen Kandidaten einer Sicherheitsüberprüfung unterzogen werden. Dein Einverständnis dafür wird rechtzeitig im Prozess erfragt.<br/><br/><strong>Benefits<br/><br/></strong><ul><li>Hybrides Arbeitsmodell.</li><li>Schichtmodell Arbeitszeiten.</li><li>An einigen Standorten eine bezuschusste Kantine und verschiedene kostenfreie Getränke.</li><li>Moderne Büroflächen mit sehr guter Verkehrsanbindung.</li><li>Diverse Mitarbeiterrabatte für Aktivitäten und Produkte.</li><li>Mitarbeiterevents wie Sommer- und Winterfeiern, sowie Workshops.</li><li>Zahlreiche Weiterbildungs- und Entwicklungsmöglichkeiten.</li><li>Verschiedene Gesundheitsangebote, wie Sport- und Gesundheitskurse.</li></ul> </div>

Job Overview
  • Datum der Veröffentlichung

    Jun 19, 2026

  • Kategorie

    IT & Software

  • Job Type

  • Standort

    Berlin, Germany

  • Arbeitgeber

    IONOS

  • Source

    LinkedIn