Logo 1&1 Internet AG

Site Reliability Engineer

Neu

Job

  • Level
    Erfahren
  • Job Feld
    IT, System, DevOps
  • Anstellung
    Vollzeit
  • Vertragsart
    Unbefristetes Dienstverhältnis
  • Ort
    Berlin
  • Arbeitsmodell
    Hybrid, Onsite
  • Job Zusammenfassung

    In dieser Rolle entwickelst du die Infrastruktur für unsere Webservices auf Kubernetes, automatisierst Prozesse mit Terraform und GitLab CI/CD und optimierst die Performance in verteilten Systemen durch Monitoring und Fehleranalyse.

    Job Technologien

    Deine Rolle im Team

    • Als Site Reliability Engineer (SRE) in unserem Application Hosting Team bildest du das technische Rückgrat unserer Produktplattform für Managed Nextcloud, Nextcloud Workspace, IONOS GPT sowie weitere Web Services, die wir auf unserer Kubernetes Plattform betreiben.
    • Gemeinsam mit erfahrenen Kolleg*innen entwirfst du neue Dienste und Produkte, die auch bei höchster Last performant und ausfallsicher bleiben.
    • Dein Haupteinsatzbereich ist die Weiterentwicklung der Infrastruktur/Plattform unserer Produkte, sowie die Integration neuer Produkte/Webdienste in unsere Kubernetes - und Cloud - Infrastruktur.
    • Du bist verantwortlich für den stabilen und sicheren Betrieb unserer Produktplattform.
    • Deine Expertise ist gefragt, wenn es um tiefgreifende Analysen und die Optimierung unserer primär containerisierten und Kubernetes-basierten Anwensungsinfrastruktur geht.
    • Du lebst Automatisierung.
    • Mit Tools wie Terraform, Gitlab CI/CD und ArgoCD provisionierst und verwaltest du unsere gesamte Infrastruktur deklarativ und reproduzierbar.
    • Du analysierst und behebst komplexe Probleme in einer verteilten Systemlandschaft und arbeitest an der stetigen Verbesserung unserer Plattform.
    • Du entwickelst und pflegst unsere Monitoring-, Logging- und Alerting-Lösung (z. B. mit Prometheus, Grafana, ELK-Stack), um proaktiv Engpässe und Fehlerquellen zu identifizieren.

    Unsere Erwartungen an dich

    Qualifikationen

    • Du hast eine proaktive, lösungsorientierte, selbstständige Arbeitsweise und die Fähigkeit, komplexe technische Probleme systematisch zu analysieren und nachhaltig zu beheben.
    • Gute Deutsch- und Englischkenntnisse sind erforderlich.

    Erfahrung

    • Du hast mehrjährige Erfahrung als Site Reliability Engineer oder in einer verwandten Rolle (Linux System Administrator, Platform Engineer, DevOps Engineer, Full Stack Developer) in einem Linux und Kubernetes Umfeld.
    • Sehr gute Kenntnisse und mehrjährige Erfahrung in der Verwendung des Linux Betriebssystems, Container-Technologien sowie speziell in Kubernetes.
    • Du hast Erfahrung mit Infrastructure as Code (vorzugsweise Terraform), CI/CD-Pipelines (z. B. GitLab CI/CD oder GitHub Actions) und in der Nutzung und Verwendung von Helm Charts.
    • Du kannst sicher in mindestens einer Programmier- oder Skriptsprache (z. B. Go, Python, Bash) entwickeln, um Automatisierungs- und Monitoring-Aufgaben zu lösen und hast eventuell schon erste Erfahrungen im Bau von Operatoren gesammelt.
    • Erfahrung mit dem Betrieb und der Fehlersuche in hochverfügbaren und verteilten Produktionsumgebungen, einschließlich der Überwachung, der Alarmierung und der Protokollanalyse verteilter Anwendungen (z. B. Prometheus, Grafana, FluentD, ELK, VictoriaMetrics, icinga).

    Unser Angebot

    • Hybrides Arbeitsmodell.
    • Flexible Arbeitszeiten durch Vertrauensarbeitszeit.
    • An einigen Standorten eine bezuschusste Kantine und verschiedene kostenfreie Getränke.
    • Moderne Büroflächen mit sehr guter Verkehrsanbindung.
    • Diverse Mitarbeiterrabatte für Aktivitäten und Produkte.
    • Mitarbeiterevents wie Sommer- und Winterfeiern, sowie Workshops.
    • Zahlreiche Weiterbildungs- und Entwicklungsmöglichkeiten.
    • Verschiedene Gesundheitsangebote, wie Sport- und Gesundheitskurse.

    Benefits

    Gesundheit, Fitness & Fun

    Work-Life-Integration

    Essen & Trinken

    Themen mit denen du dich im Job beschäftigst

    Job Standorte

    • Standort Berlin

      Deutschland

    Das ist dein Arbeitgeber

    1&1 Internet AG

    1&1 Internet AG

    Die starke Marken 1&1, GMX, WEB.DE und mail.com sind mit über 30 Millionen aktiven Nutzern führende Anbieter von Consumer-Applications in Deutschland. Wir garantieren die Sicherheit Ihrer Kommunikation - bei bis zu 500 Millionen eingehenden E-Mails pro Tag!

    Description

  • Unternehmensgröße
    250+ Employees
  • Unternehmenstyp
    Etablierte Firma
  • Arbeitsmodell
    Full Remote, Hybrid, Onsite
  • Branche
    Internet, IT, Telekom
  • Arbeitgeber-Reviews

    von devworkplaces.com

    Gesamt

    (1 Bewertung)
    3.5
    • Career Growth

      3.4
    • Workingconditions

      4.4
    • Engineering

      2.7
    • Culture

      3.5
    Alle Reviews anzeigen
    Logo 1&1 Internet AG

    Site Reliability Engineer

    Ort
    Berlin
    Arbeitsmodell
    Hybrid, Onsite
    Diversität
    Für alle Personen geeignet (m/w/d)

    Weitere Jobs