Ceph Engineer (m/w/d)
Über uns:
Wir sind Yorizon: Als Vorreiter für nachhaltige Green-IT-Cloud-Computing-Lösungen setzen wir unseren Fokus auf digitale Souveränität, Sicherheit nach europäischen Standards sowie Unabhängigkeit und Flexibilität durch den Einsatz von Open-Source-Technologien. Gegründet wurde Yorizon im Jahr 2024 mit Hauptsitz in Berlin und Wien.
Das Unternehmen engagiert sich aktiv in Open-Source-Verbänden, Netzwerken und Kooperationen (u. a. ALASCA, OSB Alliance - Open Source Business Alliance, Sovereign Cloud Stack, EuroCloud Deutschland), um Open-Source-Standards mitzugestalten und die digitale Souveränität Europas mit innovativen IT-Lösungen zu fördern.
Unsere Mission ist es, Unternehmen jeder Größe gemeinsam mit unserem Partnerökosystem dabei zu unterstützen, ihre digitale Transformation zu beschleunigen und ihre Geschäftsziele durch den Einsatz von nachhaltigen Cloud-Technologien zu erreichen.
Dein Wirkungsbereich:
Als Teil unseres Datacenter Operations-Teams berichtest Du an den Lead Plattform Architekten und verantwortest das Herzstück unserer internen Cloud-Umgebung: die Ceph-Cluster, die als Storage-Basis unserer OpenStack-Plattform dienen. Ob Block Storage für virtuelle Maschinen, Images oder S3-kompatibler Object Storage - wenn es um Daten geht, läuft alles über Deine Systeme. Gemeinsam sorgen wir dafür, dass unsere Plattformen stabil, skalierbar und hochverfügbar bleiben.
Deine Rolle:
- Ceph-Expertise einbringen. Du bist die zentrale Ansprechperson für alles rund um Ceph - von RADOS, RBD und RGW über CephFS bis hin zu CRUSH-Maps, Pool-Layouts und Placement Groups. Dein Wissen macht uns unabhängiger und schneller.
- Betrieb & Verfügbarkeit sicherstellen. Du betreibst unsere Ceph-Cluster im Tagesgeschäft. Kapazitätsplanung, Rebalancing, Scrubbing-Strategien, Hardware-Lifecycle, Upgrades im Rolling-Verfahren und ein Monitoring, das Probleme sichtbar macht, bevor sie welche werden.
- Debugging auf tiefer Ebene. Flappende OSDs, degraded oder inconsistent PGs, Netzwerkprobleme zwischen Public und Cluster Network - Du gehst den Dingen bis auf Log- und Kernel-Ebene auf den Grund und findest die Ursache statt nur das Symptom.
- Performance-Analyse & Tuning. Du misst, bevor Du optimierst. Latenzen, IOPS und Durchsatz analysierst Du systematisch und leitest daraus konkrete Verbesserungen ab.
- Architektur & Weiterentwicklung mitgestalten. Du begleitest Architektur-, Design- und Integrationsentscheidungen rund um Storage und entwickelst nachhaltige, skalierbare Lösungen - inklusive Themen wie Failure Domains, Multi-Site-Konzepte, RBD Mirroring und Disaster Recovery.
- OpenStack-Integration. Du sorgst dafür, dass das Zusammenspiel von Ceph und OpenStack sauber funktioniert, und bist Sparringspartner für unsere Plattform-Teams bei Storage-nahen Fragestellungen.
- You built it - You run it. Mit ausgeprägter Hands-on-Mentalität unterstützt Du bei Einführung, Inbetriebnahme und zuverlässigem Betrieb neuer Cluster in unseren Datacenter-Umgebungen.
- Best Practices & Wissen teilen. Du etablierst moderne Standards, dokumentierst clevere Lösungen und baust Ceph-Know-how aktiv im Team auf - Runbooks, Troubleshooting-Guides und Pairing gehören für Dich dazu.
Das bringst du mit:
- Dein Fundament (Linux & OpenSource). Du besitzt tiefgehendes Know-how im Linux-Umfeld sowie ein starkes Verständnis für Datacenter-Infrastrukturen - insbesondere Storage, Netzwerk und Virtualisierung.
- Dein Schwerpunkt (Ceph). Du hast Ceph-Cluster in Produktion betrieben, skaliert und aus schwierigen Situationen zurückgeholt. Begriffe wie MON, MGR, OSD, MDS, BlueStore, WAL/DB-Devices oder PG-Autoscaler sind für Dich Alltag, nicht Theorie. Erfahrung mit cephadm, Rook oder ceph-ansible ist ein Plus.
- Storage-Hardware-Verständnis. Du weißt, wie sich NVMe, SSD und HDD im Cluster unterschiedlich verhalten, und kannst Hardware-Auswahl und -Layout fundiert bewerten.
- Moderne Plattformen & GitOps. Du hast Erfahrung mit Kubernetes und modernen Deployment-Paradigmen wie GitOps (idealerweise mit Flux).
- Infrastruktur als Code. Automatisierung ist für Dich Standard - Du bist vertraut mit Tools wie Ansible, Terraform oder klassischen CI/CD-Pipelines. Bash oder Python zum Bauen eigener Tools und Auswertungen liegen Dir.
- Analytischer Kopf. Du durchdringst komplexe, hochverfügbare, verteilte Systemlandschaften und findest auch bei kniffligen Problemen strukturierte Lösungen - auch unter Druck, wenn Daten im Spiel sind.
- Kommunikation. Du arbeitest gerne auf Augenhöhe, teilst Dein Wissen und kommunizierst sicher auf Deutsch und Englisch.
Unser Angebot:
- Teamspirit. Du wirst Teil eines dynamischen, wachsenden Teams mit echter Du-Kultur. Wir bieten dir den Freiraum, deine Talente aktiv einzubringen und die Zukunft des Unternehmens mitzugestalten.
- Karrierechancen. Stillstand gibt es bei uns nicht. Nutze die vielfältigen Aufstiegschancen in einem expandierenden Umfeld und profitiere von unseren spannenden internationalen Perspektiven.
- Remote first. Work-Life-Balance wird bei uns großgeschrieben. Ob 100 % remote aus Deutschland oder Österreich oder hybrid an unseren Standorten in Berlin, Augsburg oder Wien.
- Deine Entwicklung. Wir investieren in dich. Mit einem eigenen Weiterbildungsbudget entscheidest du selbst, welche fachlichen oder persönlichen Skills du als Nächstes vertiefen möchtest.
- Equipment. Damit du Bestleistungen bringen kannst, kriegst du das passende Werkzeug. Wähle bei deinem Equipment frei zwischen modernsten Apple- oder Windows-Geräten.
- Mobilität. Wir unterstützen dich finanziell bei der Nutzung öffentlicher Verkehrsmittel, damit du entspannt und klimafreundlich ins Büro kommst.
- Purpose. Wenn du dich ehrenamtlich engagieren möchtest, unterstützen wir dich dabei, deinen Beitrag für die Gesellschaft zu leisten.
Bereit für die Herausforderung?
Werde Teil unserer Erfolgsgeschichte und bring deine Leidenschaft für moderne Infrastrukturen in unser Team ein. Wir sind gespannt auf deine Bewerbung!