Manager – Site Reliability Engineer

🔥 9 horas atrás

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $123.462 - $163.873 / ano

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

👻 Score fantasma 0%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Frontier Airlines

Frontier Airlines

5001 - 10000 funcionários

Fundada em 1994

✈️ Turismo

📦 Logística

🚗 Transporte

Travel • Logistics • Transport

A Frontier Airlines é uma companhia aérea comercial de baixo custo baseada nos EUA, que opera voos de passageiros programados em rotas domésticas e algumas rotas internacionais. Oferece reserva online e gestão de viagens, um programa de fidelidade (FRONTIER Miles), serviços auxiliares (taxas de bagagem, seleção de assentos, pacotes como Discount Den e GoWild Pass), ofertas de cartão de crédito co-branded e suporte ao cliente e ferramentas de viagem. A companhia aérea enfatiza viagens econômicas, promoções e iniciativas de sustentabilidade (se posicionando como uma companhia aérea verde).

Descrição

• Lead the design and implementation of highly available, resilient, and scalable cloud platforms using AWS and cloud-native technologies • Define and execute reliability strategies, SLOs, SLIs, and error budgets across critical business services • Architect and operate Kubernetes-based platforms for containerized and microservices applications • Establish enterprise standards for reliability, availability, disaster recovery, resiliency testing, and operational excellence • Partner with software engineering, platform engineering, security, and operations teams to improve reliability and reduce operational risk • Drive DevSecOps, CI/CD automation, Infrastructure as Code, and self-service platform capabilities • Define observability standards covering monitoring, logging, distributed tracing, synthetic monitoring, and operational intelligence • Lead incident response, post-incident reviews, root cause analyses, and continuous improvement • Eliminate single points of failure through proactive reliability engineering and resilient architecture • Implement automated remediation, self-healing capabilities, and proactive alerting • Lead capacity planning, performance engineering, availability management, and scalability assessments • Optimize cloud resource utilization with FinOps and engineering teams • Evaluate AIOps, Generative AI, and intelligent automation for platform reliability • Mentor SREs, platform engineers, and software engineers • Develop executive-level reliability roadmaps, operational strategies, and platform investment recommendations • Advise executive leadership on reliability strategy, operational risk, and service resiliency • Provide technical leadership during major incidents, outages, and high-severity escalations • Support PCI-DSS, SOC 2, security governance, and operational resilience compliance initiatives • Contribute to cloud transformation, platform engineering, and application modernization programs • Provide technical leadership and operational oversight for outsourced/offshore incident management resources • Manage vendor performance, incident response execution, operational effectiveness, and adherence to service-level objectives

🎯 Requisitos

• Bachelor’s degree in computer science, Engineering, Information Technology, or a related discipline • 10+ years of experience in software engineering, cloud architecture, infrastructure engineering, or enterprise architecture • 5+ years of hands-on AWS architecture and cloud transformation experience • 5+ years of leadership or management experience • Proven success leading large-scale cloud migrations and modernization initiatives • Experience designing and supporting highly available, mission-critical, customer-facing platforms • Deep understanding of Kubernetes, container orchestration, microservices, and distributed systems • Extensive experience with DevSecOps, CI/CD pipelines, Infrastructure as Code, and automation frameworks • Strong knowledge of Site Reliability Engineering (SRE), operational excellence, and platform reliability practices • Experience implementing cloud governance, FinOps, and cost optimization programs • Preferred: experience supporting large-scale enterprise, eCommerce, aviation, travel, SaaS, or high-volume digital platforms • Preferred: experience building internal developer platforms and platform engineering capabilities • AWS Professional and/or Kubernetes certifications preferred • Experience with AIOps, intelligent automation, and reliability analytics preferred • Knowledge of cloud networking and security, high availability and disaster recovery, performance engineering, capacity planning, observability, incident response, root cause analysis, CI/CD automation, configuration management, and reliability automation

🏖️ Benefícios

• Medical, dental and vision coverage • 401(k) retirement savings options • Paid holidays, vacation time and sick time • Travel privileges on Frontier Airlines and participating partner airlines • Buddy passes • Travel-related discounts and employee discounts on select products, services and vendors • A hybrid schedule for eligible headquarters roles based in Denver, Colorado • Business casual dress options for eligible corporate and support roles • Employee support programs and resources, including the HOPE League

Candidatar-se

Vagas Similares

🔥 12 horas atrás

DaVita Kidney Care

10.000+ funcionários

🏥 Saúde

⚕️ Seguro de Saúde

Senior DevOps Engineer building FinOps automation, governance, and cloud cost optimization for DaVita’s healthcare operations. Designing Kubernetes, billing-data, and infrastructure-as-code solutions.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $141.000 - $204.000 / ano

💰 Post-IPO Debt em 2021-02

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🔥 14 horas atrás

Inizio Evoke

1001 - 5000

🏥 Saúde

💼 Consultoria

📣 Marketing

Director leading AWS infrastructure, DevOps, security, and SaaS operations for Inizio Evoke, a healthcare-focused creative agency. Driving reliable, scalable, and cost-efficient technology delivery.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $135.000 - $150.000 / ano

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🔥 14 horas atrás

Salesforce

10.000+ funcionários

💼 Consultoria

📣 Marketing

☁️ SaaS

DevOps Engineer/Architect designing Salesforce deployment and CI/CD solutions for enterprise Salesforce implementations. Advising clients, governing releases, and enabling AI-first DevOps workflows.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🔥 14 horas atrás

Branch

201 - 500

💳 Fintech

👥 RH Tech

🤝 B2B

Staff Cloud Operations Engineer managing secure, scalable GCP infrastructure for Branch’s financial-services platform. Automating operations, monitoring systems, and leading incident response.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $185.000 - $200.000 / ano

💰 $16.900.000 Debt em 2025-05

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

🔥 16 horas atrás

RELX

10.000+ funcionários

💼 Consultoria

🏥 Saúde

🛡️ Seguros

Senior Site Reliability Engineer improving AWS platform reliability, automation, and observability for Elsevier’s scientific and medical information services. Deploying secure AI-powered capabilities and supporting engineering teams.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $95.300 - $158.800 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório