Site Reliability Engineer (SRE) (m/w/d)
<div class="show-more-less-html__markup show-more-less-html__markup--clamp-after-5 relative overflow-hidden"> <p><strong>Über T-Systems International GmbH</strong></p><p><br/></p><p><br/>Bei T-Systems bieten wir unseren Geschäftskunden die richtigen Systemlösungen für ihr digitales Business. Mit unserem Portfolio stellen wir sicher, dass digitale Transformation Komplexität reduziert, Kosten einspart und die alltägliche Arbeit erleichtert. Unsere Schwerpunkte sind Konnektivität, Digital, Cloud & Infrastruktur sowie Sicherheit - Let's power higher performance</p><p><br/></p><p><strong>!<br/>Über die Positi</strong></p><p><br/></p><p>on<br/>Als Site Reliability Engineer stehen Sie an vorderster Front, um die Stabilität, Performance und Skalierbarkeit unserer kritischen Systeme sicherzustellen. Sie spielen eine zentrale Rolle bei der Entwicklung, dem Aufbau und der Wartung einer hochzuverlässigen und effizienten Infrastrukt</p><ul><li>ur.Mit Ihrer Expertise in modernen Monitoring-, Observability- und Cloud-Native-Technologien gestalten Sie den Aufbau und Betrieb eines leistungsfähigen Monitoring-Stacks auf Basis von Prometheus, Grafana, Loki und AlertManager für verteilte Fog- und Edge-Infrastrukturen. Dabei entwickeln Sie spezialisierte Dashboards zur Überwachung von Hardwarezuständen, Ressourcenauslastung und Netzwerkverbindungen und schaffen so die Grundlage für einen transparenten und stabilen Betri</li><li>eb.Sie konzipieren und implementieren Alerting-Strategien für autonome Betriebsmodelle sowie Disconnected- und Air-Gap-Szenarien und stellen sicher, dass kritische Ereignisse auch unter eingeschränkten Netzwerkbedingungen zuverlässig erkannt und verarbeitet werden. Darüber hinaus verantworten Sie die Umsetzung von lokalen Retention-Konzepten, Log-Rotation-Mechanismen und effizienten Datenmanagement-Strategien für ressourcenbeschränkte Umgebung</li><li>en.Ein weiterer Schwerpunkt Ihrer Tätigkeit liegt in der kontinuierlichen Performance-Optimierung des Monitoring-Stacks unter Berücksichtigung begrenzter CPU-, Speicher- und Storage-Ressourcen auf Fog-Nodes. Sie integrieren Kubernetes-Monitoring-Lösungen, analysieren Betriebs- und Performancedaten und identifizieren proaktiv Optimierungspotenziale zur Steigerung von Stabilität, Verfügbarkeit und Effizienz der Plattfo</li><li>rm.Durch den Einsatz von Infrastructure-as-Code-Ansätzen und YAML-basierten Konfigurationen automatisieren Sie die Bereitstellung und Verwaltung der Monitoring-Komponenten und leisten einen wesentlichen Beitrag zur Weiterentwicklung einer robusten, skalierbaren und hochverfügbaren Observability-Plattform für moderne Edge- und Fog-Computing-Umgebung</li></ul><p><br/></p><p><strong>en.<br/>Must-Have Sk</strong></p><ul><li>illsMonitoring & Observabi</li></ul><p>lityFundierte Erfahrung <strong>mit Promet</strong>heus, insbesond</p><ul><li>ere:Pr</li><li>omQLFedera</li><li>tionRemote W</li><li>riteLocal Retention Manage</li><li>mentDashboarding & Visualisie</li></ul><p>rungSehr gute Kenntnisse<strong> in Gra</strong>fana, insbesond</p><ul><li>ere:Dashboard-Entwick</li><li>lungAler</li><li>tingProvisioning-as-</li><li>CodeLog Manage</li></ul><p>mentErfahrung <strong>mit </strong>Loki, insbesond</p><ul><li>ere:L</li><li>ogQLRetention Manage</li><li>mentCompac</li><li>tionAlerting & Incident Manage</li></ul><p>mentFundierte Kenntnisse<strong> in AlertMan</strong>ager, insbesond</p><ul><li>ere:Standalone Rou</li><li>tingAlert Inhibi</li><li>tionEskalations- und Benachrichtigungskonz</li><li>epteKubernetes & Cloud Na</li><li>tiveErfahrung im Monitoring und Betrieb von Kubernetes-Umgebu</li><li>ngenVerständnis von Container-Plattformen und Cloud-Native-Architekt</li><li>urenEdge & Fog Compu</li><li>tingErfahrung mit ressourcenbeschränkten Umgebu</li><li>ngenOptimierung von CPU-, Memory- und Storage-Nut</li><li>zungVerständnis von Offline-, Air-Gap- und Disconnected-Betriebsszena</li></ul><p><strong>rienWeitere Anforderun</strong></p><ul><li>gen:Sehr gute Kenntnisse in </li><li>YAMLAusgeprägtes Verständnis für IT-Sicherheit und Security Aware</li><li>nessAnalytische und strukturierte Arbeitsw</li><li>eiseErfahrung im Site Reliability Engineering oder Infrastruktur-Bet</li><li>riebSehr gutes Deutsch in Wort und Schrift (C1-Niv</li></ul><p><strong>eau)Nice-to-Have Sk</strong></p><ul><li>illsInfrastructure as Code (z. B. Terraform, Ansi</li><li>ble)GitOps-Ans</li><li>ätzeLinux-Systemadministra</li><li>tionOpenTelemetry und moderne Observability-Konz</li><li>epteErfahrung in kritischen oder hochverfügbaren Infrastrukt</li></ul><p><br/></p><p><strong>uren<br/>Was Sie erw</strong></p><p><br/></p><p>artet<br/>Sie erwartet eine spannende Aufgabe im Umfeld moderner Edge-, Fog- und Cloud-Native-Technologien. Dabei übernehmen Sie Verantwortung für die Stabilität, Verfügbarkeit und Beobachtbarkeit verteilter Infrastrukturen und gestalten den Aufbau leistungsfähiger Monitoring- und Observability-Lösungen aktiv mit. In einem technologisch anspruchsvollen Umfeld arbeiten Sie mit aktuellen Kubernetes-, Monitoring- und Logging-Technologien und tragen dazu bei, robuste und resiliente Plattformen für den zuverlässigen Betrieb auch unter herausfordernden Bedingungen zu sch</p><p><br/></p><p><strong>affen.<br/>Was wir</strong></p><p><br/></p><p><strong> bieten<br/>Flexibilität und Work-Life-</strong>Balance: Profitieren Sie von flexiblen Arbeitszeiten, der Möglichkeit zum mobilen Arbeiten und einem hybriden Arbeit</p><p><strong>smodell.Attraktive Ve</strong>rgütung: Ein wettbewerbsfähiges Gehaltspaket, das Ihre Expertise und Leistung ho</p><p><strong>noriert.Entwicklungsmöglic</strong>hkeiten: Zugang zu umfangreichen Weiterbildungsangeboten, Schulungen und Karriereentwicklungspro</p><p><strong>grammen.Modernes Arbeit</strong>sumfeld: Arbeiten Sie in einer modernen Ausstattung mit den neuesten Technologien un</p><p><strong>d Tools.Starke Unternehmen</strong>skultur: Eine offene und kollegiale Arbeitsatmosphäre, in der Teamarbeit und gegenseitige Unterstützung großgeschrieben</p><p><strong> werden.Gesundheit und Wohlb</strong>efinden: Angebote zur Gesundheitsförderung und Initiativen, die Ihr Wohlbefinden unter</p><p><strong>stützen.Zusatzlei</strong>stungen: Diverse Benefits wie betriebliche Altersvorsorge, Mitarbeiterrabatte und Jobticket-O</p><p><br/></p><p>ptionen.<br/>Die Bearbeitung Ihrer Bewerbung kann durch externe Dienstleister in Deutschland erfolgen. Bewerbungen auf Stellen außerhalb der Deutschen Telekom AG können zudem von Recruitern im europäischen Ausland bearbeitet werden. Dies gilt auch für die Bearbeitung von Bewerbungen bei Tochtergesellschaften der Deutschen Telekom AG. Für unsere beamteten Mitarbeiterinnen und Mitarbeiter deshalb folgender Hinweis: Sie sind nicht verpflichtet, Ihrer Bewerbung personalaktenrelevante Unterlagen, insbesondere Beamtenbeurteilungen, beizufügen. Es bleibt Ihnen jedoch unbenommen, diese Dokumente freiwillig zur Verfügung zu</p><p> stellen.Diese Stelle ist auch in Teilzeit</p><p> möglich.Schwerbehinderte Menschen werden bei gleicher Eignung vorrangig berück</p><p><br/></p><p>sichtigt.<br/>Bei fachlichen Fragen wenden Sie sich bitte an thomas.arbeit@t-s</p><p>ystems.comhttps://www.xing.com/companies/deutsch</p><p>etelekomaghttps://www.linkedin.com/compa</p><p><br/></p>ny/telekom </div>