Senior Site Reliability Engineer

Stelle nicht auf LinkedIn

🔥 vor 26 Minuten

🌐 Vereinigtes Königreich, Deutschland, +2 weitere Länder – Remote

infoinfo

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🇬🇧 UK-Skilled-Worker-Visum-Sponsor

infoinfo

👻 Geisterscore 13%

infoinfo

🗣️🇺🇸🇬🇧 Englisch erforderlich

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of Megaport

Megaport

201 - 500 Mitarbeiter

Gegründet 2013

📡 Telekommunikation

Networking • Cloud Computing • Telecommunications

Megaport ist ein führender Anbieter globaler privater Connectivity-Lösungen, die eine vereinfachte Netzwerk-Interconnection ermöglichen. Das Unternehmen bietet eine Plattform zur Bereitstellung sicherer, skalierbarer und agiler Netzwerke, die Rechenzentren, Clouds und virtuelle Points of Presence (PoPs) miteinander verbinden. Die Services von Megaport ermöglichen es Nutzern, sichere und dynamische Netzwerkverbindungen On-Demand zu erstellen – ohne Hardware oder langfristige Verträge – und bieten Unternehmen so maximale Flexibilität und Geschwindigkeit. Durch Partnerschaften mit globalen Service Providern, Rechenzentrumsbetreibern und Systemintegratoren gewährleistet Megaport robusten und weitreichenden Netzwerkzugang an über 930 Standorten in 25 Ländern. Intelligente Software-Tools und APIs ermöglichen ein einfaches Netzwerkmanagement und machen Megaport zu einer vertrauenswürdigen Wahl für Cloud Networking und Hybrid-Cloud-Lösungen.

Beschreibung

• Verbesserung der Zuverlässigkeit und Ausfallsicherheit von Produktionssystemen in einem SRE-Team • Förderung hoher Arbeitsstandards und bewährter Branchenpraktiken • Kommunikation mit Teams und Stakeholdern in allen Projektphasen • Einbringen neuer Ideen und Ermutigung anderer • Lösung komplexer technischer Probleme • Arbeit mit zahlreichen Technologien in einer sich schnell wandelnden Branche • Teilnahme an der Rufbereitschaft, der Reaktion auf Störungen und an blameless Post-Incident-Reviews • Schreiben von Code, Bearbeiten von Alerts, Verbesserung von Lösungen und Unterstützung anderer • Einbindung von Stakeholdern in die Anforderungsanalyse und Produktdemonstrationen • Sicherstellung, dass Systeme sicher, wartbar und verfügbar sind • Kontinuierliche Weiterentwicklung der eigenen Fähigkeiten durch Peer-Reviews und Recherche • Beitrag zum Kundenerfolg und zu den Unternehmenszielen

🎯 Anforderungen

• Mindestens 5 Jahre Erfahrung in der Administration von Linux-Systemen und zugehöriger Infrastruktur in Produktionsumgebungen • Kollaborative SRE-Mentalität sowie Vertrautheit mit SLIs, SLOs, SLAs, Error Budgets, Blast Radius und blameless Postmortems • Fokus auf Automatisierung, die Reduzierung manueller Routineaufgaben und die Vermeidung wiederkehrender Probleme • Nachweisbare Erfahrung im Erstellen von Runbooks, die für das gesamte Team und nicht nur für die eigene Arbeit geeignet sind • Sehr gute Grundlagen in Kubernetes und dem erweiterten Kubernetes-Ökosystem • Erfahrung mit Cloud-Infrastrukturen; AWS wird dringend bevorzugt, Erfahrung mit Bare-Metal-Systemen ist ein Plus • Sehr gute Fähigkeiten in der Entwicklung von Tools – Bash sowie bevorzugt Python oder Go beziehungsweise vergleichbare Technologien • Erfahrung mit Infrastructure-as-Code-Tools – Terraform wird bevorzugt • Erfahrung mit CI/CD und Versionskontrolle, bevorzugt GitHub • Datenbankerfahrung – bevorzugt mit PostgreSQL, Cassandra oder ClickHouse • Erfahrung im Betrieb eines Observability-Stacks für Produktionsumgebungen (Metriken, Logs und Traces) mit einem ausgeprägten Gespür für relevante Signale statt für Rauschen • Sicherer Umgang mit laufender Produktionsinfrastruktur, ausgeprägte Fähigkeiten bei der Fehlersuche und Verantwortungsbewusstsein bei der Reaktion auf Störungen • Kontinuierliche fachliche Weiterentwicklung • Selbstständige Arbeitsweise, die zu einem asynchron arbeitenden, global verteilten Team passt, sowie Bereitschaft, bei Bedarf angrenzende Aufgaben zu übernehmen

🏖️ Vorteile

• Flexibles Arbeitsumfeld – eine Remote-First-Kultur mit verfügbaren Coworking-Optionen • Großzügige Urlaubsregelungen – einschließlich 4 Wochen bezahltem Jahresurlaub, Elternzeit, Geburtstagsurlaub und einem Programm zum zusätzlichen Erwerb von Urlaubstagen • Unterstützung für Gesundheit und Wohlbefinden – durch ein Wellness-Budget und Initiativen zur Förderung des Wohlbefindens der Mitarbeitenden • Umfassende Unterstützung beim Lernen – großzügiges Budget für Weiterbildung und Schulungen sowie 5 bezahlte Lerntage • Kreative, moderne Arbeitsplätze – inspirierend gestaltet für die Zeit, in der nicht remote gearbeitet wird • Motiviertes, inklusives Team – Zusammenarbeit mit Branchenexpertinnen und -experten sowie Nachwuchskräften • Anerkennungsprogramme – Würdigung von Erfolgen mit den Auszeichnungen „Legend“ und „Kudos“

Jetzt Bewerben

Ähnliche Jobs

🕒 vor 1 Tag

Trust Payments

501 - 1000

💳 Fintech

🤝 B2B

Senior DevOps Engineer maintaining secure, scalable AWS infrastructure and internal platforms. Supporting Trust Payments’ global fintech and payments solutions.

🇬🇧 Vereinigtes Königreich – Remote

💰 Series unknown im 2013-12

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 2 Tagen

Aker Systems

51 - 200

🤖 Künstliche Intelligenz

🔒 Cybersecurity

Lead DevOps Engineer building secure AWS cloud infrastructure and analytical data platforms for enterprise clients. Automating deployments, supporting production systems, and mentoring delivery teams.

🇬🇧 Vereinigtes Königreich – Remote

💰 Venture Round im 2020-07

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 3 Tagen

Salve.Inno

11 - 50

💼 Beratung

📣 Marketing

📦 Logistik

Senior SRE operating AWS and Kubernetes cloud platforms for mission-critical production services. Improving observability, automation, incident response, and reliability across engineering teams.

🇬🇧 Vereinigtes Königreich – Remote

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 3 Tagen

Salve.Inno

11 - 50

💼 Beratung

📣 Marketing

📦 Logistik

Senior Site Reliability Engineer operating AWS and Kubernetes cloud platforms for global customers. Improving observability, automation, incident response, and production reliability.

🇬🇧 Vereinigtes Königreich – Remote

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 7 Tagen

CrowdStrike

5001 - 10000

🔒 Cybersecurity

☁️ SaaS

🤖 Künstliche Intelligenz

Site Reliability Engineer maintaining CrowdStrike’s large-scale cybersecurity cloud platform. Automating operations, monitoring distributed systems, and leading incident response for reliable 24x7 service.

🗣️🇺🇸🇬🇧 Englisch erforderlich