Senior Site Reliability Engineer (m/w/d)

🔥 vor 2 Stunden

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of Flip

Flip

51 - 200 Mitarbeiter

Gegründet 2018

👥 HR Tech

☁️ SaaS

🤖 Künstliche Intelligenz

HR Tech • SaaS • Artificial Intelligence

Flip ist die KI-Plattform für das Mitarbeitererlebnis von Frontline- und Deskless-Mitarbeitern. Die Plattform vereint interne Kommunikation, HR-Self-Service (Gehaltsabrechnungen, Urlaub, Onboarding), ein KI-natives Intranet, KI-gestützte Workflows und Identitätsmanagement für Frontline-Mitarbeiter in einer einzigen, mobil optimierten App, die auf jedem Gerät funktioniert – auch auf gemeinsam genutzten Telefonen ohne Firmen-E-Mail. Flip enthält eine KI-Schicht (Flip Intelligence / Ask AI), einen App-Builder und Integrationen mit bestehenden Tools (SharePoint, Teams, HR-Systeme) und richtet sich an Branchen mit großen, nicht-schreibtischgebundenen Arbeitskräften. Zu den Kunden zählen Ben & Jerry's, Bosch, KFC und PENNY, was den Einsatz im Einzelhandel, in der Gastronomie, in der Fertigung und in der Logistik demonstriert.

Beschreibung

• Co-Owner der Architektur: Hilf dabei, die Architektur und Weiterentwicklung unserer Cloud-Infrastruktur auf Azure und unserer Kubernetes-Cluster voranzutreiben – konzipiert für hohen Durchsatz und höchste Verfügbarkeit – um Flips schnelles globales Wachstum zu unterstützen. • Die Resilience-Strategie vorantreiben: Definiere unseren Ansatz für globales Skalieren, Zero-Downtime-Deployments, Rollback-Mechanismen sowie Disaster Recovery und stelle sicher, dass die Plattform rund um die Uhr verfügbar bleibt. • Unseren Observability-Stack weiterentwickeln: Optimiere unseren LGTM-Stack (Loki, Grafana, Tempo, Mimir) zu einem Fundament, dem unsere Engineers vertrauen können. • Unsere IaC-Plattform verbessern: Du eliminierst Routineaufwand an der Quelle und machst unsere Infrastruktur für die Engineering-Teams zu einem echten Self-Service. • Führung bei Incidents: Du übernimmst eine führende Rolle bei größeren Plattform-Störungen, leitest sachliche Fehleranalysen (Blameless Post-Mortems) und wandelst Erkenntnisse in dauerhafte Verbesserungen um. • Mentoring innerhalb des Squads: Coache Teammitglieder, leite RFCs und Design-Reviews im Team und hilf Engineers dabei, sich zu stärkeren SREs zu entwickeln. • Unsere Roadmap gestalten: Arbeite partnerschaftlich mit deinem Squad zusammen, um die Richtung der Plattform zu definieren.

🎯 Anforderungen

• 5+ Jahre Hands-on-Erfahrung als Site Reliability Engineer (SRE), Platform Engineer, DevOps Engineer, Infrastructure Engineer, Cloud Engineer oder Backend Engineer mit starkem Infrastruktur-Fokus. • Nachgewiesene Erfolgsbilanz beim Aufbau und Betrieb von hochverfügbaren High-Throughput-Systemen in der Produktion. • Tiefe Erfahrung auf Produktionsniveau mit Kubernetes auf einem der gängigen Hyperscaler. • Fundierte Erfahrung mit modernen Observability-Stacks (z. B. Prometheus, Mimir, VictoriaMetrics, Dash0, Loki, ELK) und eine klare Sichtweise auf SLIs, SLOs und Error Budgets. • Solide Software-Development-Skills in Go (stark bevorzugt, da unser IaC auf Pulumi in Go läuft) oder Python. • Hands-on-Erfahrung mit Infrastructure as Code (Pulumi, OpenTofu, Terraform) und GitOps (z. B. ArgoCD) + CI/CD Pipeline-Design. • Nachgewiesene Fähigkeit, komplexe Infrastruktur-Initiativen vom Design bis zur Produktion zu leiten – einschließlich des Schreibens von RFCs und des Vorantreibens von Architektur-Entscheidungen in deinem Team. • Erfahrung im Mentoring von Engineers und darin, das technische Niveau innerhalb eines Teams anzuheben. • Souveräne End-to-End-Verantwortung bei kritischen Störungen und die Fähigkeit, daraus gewonnene Erkenntnisse in nachhaltige technische Verbesserungen zu überführen. • Starke Kommunikationsfähigkeiten und verhandlungssicheres Englisch. • Bereitschaft zur Teilnahme an Rufbereitschaften (On-Call), um die Zuverlässigkeit unserer Plattform zu gewährleisten.

🏖️ Vorteile

• Work-Mode: Wir sind remote-first und geben dir damit die Flexibilität, von zu Hause aus zu arbeiten. Gleichzeitig schätzen wir den Mehrwert der persönlichen Zusammenarbeit sehr. Je nach Rolle nimmst du gelegentlich an Team-Events, Workshops oder Meetings in unseren Büros in Berlin oder Stuttgart teil – selbstverständlich immer mit ausreichend Vorlauf. Das genaue Verhältnis besprechen wir transparent während deines Bewerbungsprozesses. • Work-Life-Balance: Wir wollen nicht, dass du an deinem Schreibtischstuhl festwächst und übernehmen deshalb die Kosten für deine E-Gym-Wellpass-Mitgliedschaft und bieten Job-Rad Leasing an. • Erfolge feiern: Dich erwarten hoch motivierte und engagierte Menschen in einer lockeren Arbeitsatmosphäre. • Mittendrin statt nur dabei: Du gestaltest Flip aktiv mit. Ganz nebenbei bist du Enabler des rasanten Wachstumsprozesses eines jungen Tech-Unternehmens und wächst an deinen Zielen. Gute Laune garantiert. • Happy to be a Flipster: Freu dich auf regelmäßige Teamevents und Culture Days, die uns als Flipster zusammenschweißen. • Arbeiten im Ausland: Bei Flip kannst du auch im europäischen Ausland arbeiten, lass uns im Interview über Workation sprechen.

Jetzt Bewerben

Ähnliche Jobs

🔥 vor 21 Stunden

Lisk

11 - 50

₿ Crypto

🌐 Web 3

💳 Fintech

DevOps Engineer, verantwortlich für die AWS-Infrastruktur der FinTech-Plattform von Lisk. Weiterentwicklung der Cloud-Infrastruktur sowie Gewährleistung von Sicherheit und Zuverlässigkeit in einer Remote-first-Umgebung.

🇪🇺 Europa – Remote

💰 Seed im 2024-02

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 4 Tagen

Bet On Talent

1 - 10

💼 Beratung

📣 Marketing

🎯 Rekrutierung

Senior DevSecOps Engineer, verantwortlich für die Implementierung und Unterstützung technologischer Lösungen. Aufbau von CI/CD-Pipelines und Monitoring-Systemen in einem vollständig remote arbeitenden Umfeld, überwiegend aus Europa.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 8 Tagen

Zencoder

11 - 50

☁️ SaaS

📱 Medien

🔌 API

Ingenieur, der beim Aufbau und Betrieb der Infrastruktur hinter Zencoders KI-gestützten Produkten mitarbeitet. Fokus auf Zuverlässigkeit, Sicherheit, Skalierbarkeit und Kosteneffizienz in Produktionsplattformen.

🇪🇺 Europa – Remote

💰 Venture Round im 2014-01

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 10 Tagen

DualEntry

51 - 200

☁️ SaaS

🤖 Künstliche Intelligenz

🏢 Unternehmen

Site Reliability Engineer, der Zuverlässigkeit und Performance bei DualEntry, einem KI-nativen ERP-Startup, verbessert. Hands-on-Rolle mit Fokus auf Infrastruktur und Monitoring sowie hohen Erwartungen an Exzellenz.

🇪🇺 Europa – Remote

💵 $140.000 - $240.000 / Jahr

🔥 Finanzierung im letzten Jahr

💰 €90.000.000 Series A - DualEntry im 2025-10

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 18 Tagen

Mimica

11 - 50

💼 Beratung

📦 Logistik

🏥 Gesundheitswesen

DevOps/Plattform-Engineer bei Mimica, einem KI-gestützten Task-Mining-Startup. Unterstützung beim Betrieb resilienter Anwendungen und Verwaltung der Infrastruktur über mehrere Regionen.

🗣️🇺🇸🇬🇧 Englisch erforderlich