Site Reliability Engineer (SRE)

Stelle nicht auf LinkedIn

🔥 vor 9 Minuten

🌏 Überall auf der Welt

⏰ Vollzeit

🟠 Senior

🔴 Experte

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of Yuno

Yuno

11 - 50 Mitarbeiter

💳 Fintech

🏢 Unternehmen

☁️ SaaS

Fintech • Enterprise • SaaS

Yuno ist ein Unternehmen, das weltweit Payment-Orchestration und Infrastruktur-Lösungen bereitstellt. Die Technologie von Yuno ermöglicht es Unternehmen, über 300 Zahlungsmethoden zu integrieren, steigert die Akzeptanzraten und erlaubt das nahtlose Skalieren der Payment Operations über mehrere Regionen hinweg. Yuno konzentriert sich auf einen vereinfachten Payment-Prozess mit Funktionen wie: • Smart Routing • Unified Payment Insights • Auto Reconciliation • Custom Checkout-Optionen Yuno legt besonderen Wert auf Sicherheit und Fraud-Management, um sichere Transaktionen zu gewährleisten. Darüber hinaus erleichtert Yuno globale Payouts und Subscription Management und ist damit ein idealer Partner für Unternehmen, die ihre Payment-Systeme optimieren und den Umsatz steigern möchten.

Beschreibung

• Legen Sie die technische Ausrichtung für Zuverlässigkeit in Yunоs Infrastruktur fest, beginnend mit der AWS-Plattform, die KI-Agenten in großem Maßstab bereitstellt, deployt und verwaltet • Verantwortung für die Plattform-Zuverlässigkeitsstrategie, einschließlich Architekturentscheidungen, Messung der Zuverlässigkeit und technischen Standards • Definieren Sie eine SLO-Kultur, Richtlinien für das Fehlerbudget und Incident-Praktiken für die Engineering-Teams • Entwerfen und betreiben Sie dauerhafte, zuverlässige asynchrone Messaging-Lösungen für die Inter-Service-Kommunikation • Verantwortung für Cloud-Infrastruktur und Automatisierung der Bereitstellung mittels Infrastructure as Code • Sicherstellen, dass die Plattform bei steigendem Transaktionsvolumen zuverlässig skaliert • Aufbau von Monitoring-, Tracing- und Alerting-Systemen zur Überwachung der Plattformgesundheit • Dienen Sie als Senior-Eskalationsstelle für schwierige Produktionsvorfälle • Durchführung von Postmortems ohne Schuldzuweisungen und Ursachenanalysen, die dauerhafte Lösungen hervorbringen • Kontinuierliche Fault-Injection-Tests und Resilienz-Experimente durchführen • Mentoring für Senior- und Mid-Level-Ingenieure und Anheben der organisationsweiten Zuverlässigkeitsstandards

🎯 Anforderungen

• Mindestens 7 Jahre Erfahrung • Entwurf und Betrieb ereignisgesteuerter Systeme mit Message Queues wie Kafka, NATS oder RabbitMQ • Kenntnisse zu at-least-once-Delivery, Consumer Groups, Dead Letters und Backpressure • Erfahrung in der Migration von Systemen von synchroner zu asynchroner Kommunikation • Tiefgehende AWS-Erfahrung mit EC2, VPC, IAM, S3 und RDS • Solide Netzwerkgrundlagen • Erfahrung mit Infrastructure as Code, z. B. Terraform oder Pulumi • Production-Erfahrung mit Kubernetes und Docker, einschließlich Container-Lifecycle, Ressourcenlimits, Health Checks und Orchestrierung in großem Maßstab • Datadog-Erfahrung oder gleichwertige Kenntnisse in Dashboards, Monitoren, APM und verteiltem Tracing • Nachweisliche Erfahrung beim Definieren und Betreiben von SLOs, SLIs und Fehlerbudgets über Services hinweg • Praktische Erfahrung mit Fault-Injection-, Game-Day- oder Chaos-Experimenten (z. B. Gremlin, Chaos Mesh, AWS FIS oder ähnlich) • Erfahrung im Debugging verteilter Systeme • Sicheres Entwickeln von Automatisierungen und Tools in Go, Python oder ähnlichen Sprachen • Gute SQL- und PostgreSQL-Kenntnisse • NoSQL-Erfahrung mit MongoDB und Redis, einschließlich Indexierung, Replikation und Performance-Tuning • Nachgewiesene technische Führung, Einfluss auf die Architektur über Teams hinweg und Mentoring • Fortgeschrittene Englischkenntnisse in Wort und Schrift

🏖️ Vorteile

• Wettbewerbsfähige Vergütung • Remote-Arbeit — Arbeit von überall möglich • Home-Office-Zuschuss — einmalige Unterstützung zur Einrichtung Ihres idealen Home-Office • Arbeitsausstattung • Aktienoptionen • Gesundheitsplan unabhängig von Ihrem Standort • Flexible freie Tage • Sprach-, Berufs- und Persönlichkeitsentwicklungskurse

Jetzt Bewerben

Ähnliche Jobs

🕒 vor 13 Tagen

Empowers Staffing Inc

11 - 50

💼 Beratung

🎯 Rekrutierung

🤖 Künstliche Intelligenz

Infrastructure Automation Engineer bei LAK Technology Inc. verwaltet Cloud-Infrastrukturen mit Terraform und Ansible. Fokus auf Automatisierung und CI/CD-Prozesse in AWS-, Azure- oder GCP-Umgebungen.

🌏 Überall auf der Welt

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 13 Tagen

Supabase

51 - 200

☁️ SaaS

🔌 API

🤖 Künstliche Intelligenz

Release Engineer bei Supabase, verantwortlich für sichere, beobachtbare Deployments und operative Zuverlässigkeit über die Systeme hinweg. Mitarbeit im Incident‑Management, Monitoring und in der Prozessdokumentation zur Steigerung der Deployment‑Effizienz.

🌏 Überall auf der Welt

💰 €80.000.000 Series B im 2022-05

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 20 Tagen

Social Discovery Group

1001 - 5000

🌍 Soziale Wirkung

📱 Medien

DevOps Engineer, der interne Dienste und Tools in Go für Produkte im Bereich Social Discovery entwickelt. Zusammenarbeit an der Deployment-Automatisierung in einer Remote-Arbeitsumgebung mit einem globalen Team.

🌏 Überall auf der Welt

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇷🇺 Russisch erforderlich

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 29 Tagen

GitLab

1001 - 5000

💼 Beratung

📣 Marketing

🤖 Künstliche Intelligenz

Site Reliability Engineer, der die Zuverlässigkeit der für Endnutzer sichtbaren GitLab-Dienste sicherstellt. Unterstützung der operativen Exzellenz durch ingenieurwissenschaftliche Prinzipien und Automatisierung.

🌏 Überall auf der Welt

💵 $126.400 - $314.400 / Jahr

💰 Secondary Market im 2020-11

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 1 Monat

Onchain

51 - 200

💸 Finanzen

💳 Fintech

₿ Crypto

DevOps-Ingenieur, der die Cloud-Infrastruktur hinter der Finanzplattform von Lisk beim Skalieren weiterentwickelt. Tritt einem Remote-first-Team bei, um Sicherheit und Zuverlässigkeit von geldverarbeitenden Systemen zu verbessern.

🌏 Überall auf der Welt

💰 Series B im 2018-07

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich