Release Engineer

Stelle nicht auf LinkedIn

🔥 vor 14 Minuten

🌏 Überall auf der Welt

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of Supabase

Supabase

51 - 200 Mitarbeiter

Gegründet 2020

☁️ SaaS

🔌 API

🤖 Künstliche Intelligenz

💰 €80.000.000 Series B im 2022-05

SaaS • API • Artificial Intelligence

Supabase ist eine Open-Source-Alternative zu Firebase und bietet Entwicklerinnen und Entwicklern eine umfassende Backend-as-a-Service-Plattform. Die Lösung umfasst unter anderem eine Postgres-Datenbank, Benutzerauthentifizierung mit Row Level Security (RLS), sofort verfügbare RESTful APIs, Edge Functions für die Bereitstellung von benutzerdefiniertem Code sowie Echtzeit-Datensynchronisierung. Darüber hinaus unterstützt Supabase die Speicherung großer Dateien und die Integration mit Machine-Learning-Modellen für Vektor-Embeddings. Mit der Plattform können Entwicklerinnen und Entwicklern skalierbare Anwendungen mühelos entwickeln und die robusten Möglichkeiten von Postgres nutzen, ohne Backend-Infrastruktur selbst betreiben zu müssen. Mit dem Ziel, Entwicklungs-Workflows zu vereinfachen, wird Supabase weltweit von Unternehmen aufgrund seiner Zuverlässigkeit und Performance geschätzt und unterstützt die Skalierung von Projekten von kleinen bis hin zu großen Nutzerbasen.

Beschreibung

• Übernehmen Sie die Zuverlässigkeit von Supabases Deployment- und Release-Systemen sowie der zugrunde liegenden Control Plane, anhand klarer SLOs und Error Budgets • Machen Sie Pre-Production zu einem vertrauenswürdigen Signal — standardisieren und instrumentieren Sie die heute fragmentierten, adhoc‑Deployment‑Workflows • Steigern Sie die Disaster‑Recovery‑Bereitschaft, indem Sie Umgebungen reproduzierbar von Grund auf deploybar machen (Auflösen undokumentierter Secrets, unklarer Verantwortung für Konfigurationen und zirkulärer Service‑Abhängigkeiten) • Erstellen und betreiben Sie Health‑ und SLO‑Monitoring für kritische Nutzer‑Flows; nutzen Sie synthetische Tests, um Regressionen zu erkennen, bevor Kunden sie bemerken • Reduzieren Sie Mean Time to Detect und Mean Time to Recover für deploy‑bezogene Incidents — die einen großen Anteil unserer Incident‑Last ausmachen • Nehmen Sie am On‑Call teil, führen Sie blameless Postmortems durch und übertragen Sie Erkenntnisse in Runbooks, Alerting und Automatisierung, die Toil reduzieren • Verbessern Sie die Observability und Auditierbarkeit von Deployments — eine eindeutige Aufzeichnung dessen, was wann, wo und von wem ausgeliefert wurde • Dokumentieren Sie Betriebsabläufe — Break‑Glass‑Pfad, Zugangsmodelle und Runbooks — damit Zuverlässigkeitswissen nicht nur tribal vorhanden ist • Definieren und verfolgen Sie SLAs, SLOs, Error Budgets und DORA‑Delivery‑Metriken — mit sinnvollem Alerting statt Rauschen • Sorgen Sie dafür, dass Deployments schnell und sicher fehlschlagen, wenn Health‑Checks sich verschlechtern • Härten Sie Zugriff‑ und Break‑Glass‑Workflows (z. B. scoped self‑service), sodass die richtigen Personen in einem Incident ohne unsichere Workarounds handeln können • Arbeiten Sie mit Produkt‑Engineering und Plattform‑Teams zusammen, um Release‑Praktiken mit Zuverlässigkeits‑ und Verfügbarkeitszielen in Einklang zu bringen

🎯 Anforderungen

• Mindestens 5 Jahre Erfahrung in SRE, Produktionsbetrieb, Platform Engineering oder Release Engineering • Erfahrung im Betrieb produktiver Systeme in großem Maßstab und Übernahme von On‑Call‑Verantwortung • Fundierte Kenntnisse in SLAs, SLOs, Error Budgets, DORA‑Metriken und operationalen KPIs sowie der zugehörigen Observability‑Tools (Prometheus, Grafana, Alertmanager oder vergleichbar) • Leitung der Incident‑Response mit Tools wie incident.io (oder PagerDuty / Opsgenie), Durchführung blameless Postmortems und nachweisliche Senkung von MTTD/MTTR • Souveräner Betrieb in AWS (mehrere Accounts, IAM, VPC) im Produktionsumfeld • Sicherer Umgang mit Infrastructure‑as‑Code (Pulumi, Terraform) und Kubernetes • Skripten und Automatisieren zur Eliminierung von Toil statt dessen Übernahme • Klare Kommunikation mit Infrastruktur‑Spezialisten und Produkt‑Ingenieuren • Erfolgreiches Arbeiten in asynchronen, global verteilten Teams • Komfort im Umgang mit Ambiguität und iterative Verbesserung von Systemen im Zeitverlauf

🏖️ Vorteile

• Vollständig remote • Mitarbeiterbeteiligung (ESOP) • Technikzuschuss / Hardwarebudget • Gesundheitsleistungen • Jährliche Offsites • Flexible Arbeitsgestaltung • Berufliche Weiterbildung

Jetzt Bewerben

Ähnliche Jobs

🕒 vor 6 Tagen

Social Discovery Group

1001 - 5000

🌍 Soziale Wirkung

📱 Medien

DevOps Engineer, der interne Dienste und Tools in Go für Produkte im Bereich Social Discovery entwickelt. Zusammenarbeit an der Deployment-Automatisierung in einer Remote-Arbeitsumgebung mit einem globalen Team.

🌏 Überall auf der Welt

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇷🇺 Russisch erforderlich

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 16 Tagen

GitLab

1001 - 5000

💼 Beratung

📣 Marketing

🤖 Künstliche Intelligenz

Site Reliability Engineer, der die Zuverlässigkeit der für Endnutzer sichtbaren GitLab-Dienste sicherstellt. Unterstützung der operativen Exzellenz durch ingenieurwissenschaftliche Prinzipien und Automatisierung.

🌏 Überall auf der Welt

💵 $126.400 - $314.400 / Jahr

💰 Secondary Market im 2020-11

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 17 Tagen

Growe Talents

11 - 50

💼 Beratung

📣 Marketing

🎯 Rekrutierung

DevSecOps-Rolle zum Aufbau und zur eigenverantwortlichen Leitung der Sicherheitsfunktion bei Growe Talents, Bewertung der Sicherheitslage und Implementierung von Kontrollen über den gesamten Entwicklungslebenszyklus.

🌏 Überall auf der Welt

⏰ Vollzeit

🟢 Junior

🟡 Mittelstufe

⛑ DevOps- und Site Reliability Engineer (SRE)

🚫👨‍🎓 Kein Abschluss erforderlich

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 18 Tagen

Onchain

51 - 200

💸 Finanzen

💳 Fintech

₿ Crypto

DevOps-Ingenieur, der die Cloud-Infrastruktur hinter der Finanzplattform von Lisk beim Skalieren weiterentwickelt. Tritt einem Remote-first-Team bei, um Sicherheit und Zuverlässigkeit von geldverarbeitenden Systemen zu verbessern.

🌏 Überall auf der Welt

💰 Series B im 2018-07

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 2 Monaten

Chess.com

501 - 1000

🎮 Gaming

📚 Bildung

📱 Medien

Site Reliability Engineer bei Chess.com, verantwortlich für Infrastrukturstabilität und skalierbare Systeme für Millionen von Nutzern. Die Position spielt eine zentrale Rolle bei der Unterstützung schneller Feature‑Entwicklung und -Bereitstellung.

🌏 Überall auf der Welt

💰 Private Equity Round im 2022-01

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich