Job
- Level
- Senior
- Ort
- Berlin
- Arbeitsmodell
- Hybrid, Onsite
- Job Feld
- Back End
- Anstellung
- Vollzeit
- Vertragsart
- Unbefristetes Dienstverhältnis
Job Zusammenfassung
In dieser Rolle entwickelst du Lösungen für unsere Ceph-basierte Object-Storage-Plattform, arbeitest eng mit dem Operations-Team und optimierst die Verfügbarkeit, Performance und Sicherheit unserer Systeme.
Job Technologien
Deine Rolle im Team
- Staff Storage Reliability Engineer für unsere globale, öffentliche Object-Storage-Plattform, die auf Ceph basiert.
- Du entwickelst Lösungen, die in der Produktion skalieren, und arbeitest mit unserem Operations-Team zusammen, um die Plattformen zu bauen, zu deployen und zu betreuen.
- Derzeit liegen wir im zweistelligen Peta-Byte-Bereich, verteilt über mehrere Standorte.
- Unsere Ceph-Plattform wächst schnell und ist ein kritischer Bestandteil unserer internen und öffentlichen Infrastruktur.
- Du wirst aktiv an der Weiterentwicklung mitwirken, unsere Produktionsumgebungen verbessern und betreuen und dafür sorgen, dass Verfügbarkeit, Performance und Sicherheit beim Skalieren erhalten bleiben.
- Ceph-Cluster bereitstellen, konfigurieren und betreiben - inklusive der Verwaltung von Storage-Pools, Placement-Groups und weiteren Kernkomponenten.
- Ceph für optimale Leistung abstimmen, Engpässe beseitigen und eine effiziente Ressourcennutzung sicherstellen.
- Automatisierungs-Strategien für Ceph-Deployments, Upgrades und Wartungsaufgaben entwickeln und umsetzen.
- Komplexe technische Probleme im Zusammenhang mit Ceph-Storage diagnostizieren und beheben - häufig in Zusammenarbeit mit anderen Teams.
- Eng mit Entwicklungsteams, System-Administratoren und anderen Stakeholdern kooperieren, um Ceph in verschiedene Systeme und Anwendungen zu integrieren.
- Die neuesten Ceph-Entwicklungen, neuen Features und Best-Practices verfolgen.
- In der Ceph-Community aktiv mitwirken und Wissen teilen.
Unsere Erwartungen an dich
Qualifikationen
- Fundierte Kenntnisse in Ceph-Architektur und -Administration.
- Praxis mit Automatisierungstools (z. B. Ansible) sowie Monitoring- und Observability-Lösungen.
- Vertrautheit mit Cloud-Plattformen und Container-Technologien (z. B. Docker).
- Hervorragende Fähigkeiten zur Fehlersuche und Problemlösung, starke Kommunikations- und Kollaborationsfähigkeiten.
Erfahrung
- 5+ Jahre Erfahrung als Senior Linux Engineer oder Site Reliability Engineer; tiefes und breites Verständnis von Linux-Systemen und Netzwerken.
- Erfahrung mit Cloud-Storage-Technologien (File, Object, Block).
Unser Angebot
- Hybrides Arbeitsmodell.
- Flexible Arbeitszeiten durch Vertrauensarbeitszeit.
- An einigen Standorten eine bezuschusste Kantine und verschiedene kostenfreie Getränke.
- Moderne Büroflächen mit sehr guter Verkehrsanbindung.
- Diverse Mitarbeiterrabatte für Aktivitäten und Produkte.
- Mitarbeiterevents wie Sommer- und Winterfeiern, sowie Workshops.
- Zahlreiche Weiterbildungs- und Entwicklungsmöglichkeiten.
- Verschiedene Gesundheitsangebote, wie Sport- und Gesundheitskurse.
Benefits
Gesundheit, Fitness & Fun
Work-Life-Integration
Essen & Trinken
Themen mit denen du dich im Job beschäftigst
Job Standorte
Das ist dein Arbeitgeber
1&1 Internet AG
Die starke Marken 1&1, GMX, WEB.DE und mail.com sind mit über 30 Millionen aktiven Nutzern führende Anbieter von Consumer-Applications in Deutschland. Wir garantieren die Sicherheit Ihrer Kommunikation - bei bis zu 500 Millionen eingehenden E-Mails pro Tag!
Description
- Unternehmensgröße
- 250+ Employees
- Unternehmenstyp
- Etablierte Firma
- Arbeitsmodell
- Full Remote, Hybrid, Onsite
- Branche
- Internet, IT, Telekom
Arbeitgeber-Reviews
von devworkplaces.com
Gesamt
(1 Bewertung)3.5
Career Growth
3.4Workingconditions
4.4Engineering
2.7Culture
3.5