Site Reliability Engineering Lead

🕒 Setembro 23

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $118.300 - $219.800 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

👻 Score fantasma 4%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of RELX

RELX

10.000+ funcionários

💼 Consultoria

🏥 Saúde

🛡️ Seguros

Consulting • Healthcare • Insurance

A RELX é uma fornecedora global de análises baseadas em informações e ferramentas de decisão para clientes profissionais e empresariais. A empresa se concentra em permitir que seus clientes tomem decisões melhores, melhorem resultados e aumentem a produtividade aproveitando a tecnologia avançada e os dados. A RELX atende diversos setores, incluindo Risco, Científico, Técnico & Médico, Jurídico e Exposições, oferecendo informações especializadas e ferramentas analíticas que facilitam a tomada de decisões críticas. A empresa está comprometida com a responsabilidade corporativa e em oferecer benefícios à sociedade por meio de seus produtos, contribuindo para o avanço científico, justiça legal e transações de mercado eficazes.

Descrição

• Lead and mentor a team of Site Reliability Engineers • Define and drive SRE strategy, standards, best practices, and operational frameworks • Improve application reliability, scalability, security, performance, and resilience across product and platform teams • Establish and maintain SLOs, SLIs, and error budgets • Lead major incident management, root cause analysis, problem management, and post-incident reviews • Drive cloud modernization and application migrations to Azure, AWS, and containerized environments • Champion automation and Infrastructure as Code practices using Terraform, GitHub, GitLab, Jenkins, and Ansible • Develop and implement observability strategies using metrics, logs, traces, alerting, and dashboards • Collaborate with security and compliance teams on enterprise requirements • Lead architecture reviews and guide cloud-native, resilient application designs • Drive capacity planning, performance optimization, cost management, and operational efficiency • Establish engineering guardrails, governance controls, and production deployment standards • Support organizational transformation toward DevOps and SRE practices • Manage operational risk and business continuity/disaster recovery preparedness • Prioritize reliability improvements and platform investments with stakeholders • Build relationships with product owners, engineering leaders, vendors, and business partners • Conduct resource planning and support hiring, onboarding, and career development • Establish team objectives aligned with business and technology strategies • Promote accountability, innovation, and operational excellence • Act as a reliability engineering subject matter expert and trusted advisor • Drive cross-team collaboration on strategic initiatives

🎯 Requisitos

• 8+ years of experience in Cloud Engineering, DevOps, Platform Engineering, Infrastructure Engineering, or Site Reliability Engineering • 2+ years of leadership or people management experience leading engineering teams • Bachelor's degree in Computer Science, Engineering, Information Systems, or equivalent practical experience • Strong leadership experience managing technical engineering teams • Deep expertise in Site Reliability Engineering, DevOps, Cloud Engineering, or Platform Engineering • Extensive experience with Azure and/or AWS cloud platforms • Strong understanding of Kubernetes, AKS, EKS, containerization, Docker, and cloud-native architectures • Expertise with Infrastructure as Code tools such as Terraform and Ansible • Strong background in observability platforms such as Grafana, Prometheus, OpenTelemetry, Splunk, Dynatrace, Datadog, or similar technologies • Experience managing large-scale production environments with stringent availability requirements • Strong understanding of security, compliance, networking, and cloud governance principles • Experience designing highly available, fault-tolerant, and resilient systems • Strong proficiency in at least one scripting or programming language such as Python, Go, PowerShell, Bash, or C# • Experience with CI/CD pipelines and software delivery automation • Exceptional troubleshooting and problem-solving capabilities • Excellent communication and stakeholder management skills • Strong documentation and presentation skills • Ability to influence technical direction across multiple engineering organizations • Azure, AWS, Kubernetes, Terraform, or related certifications preferred • Proven track record leading reliability and operational excellence initiatives in large-scale enterprise environments

🏖️ Benefícios

• Annual incentive bonus eligibility • Country-specific benefits • Reasonable accommodations and adjustments during the hiring process • Equal opportunity employment

Candidatar-se

Vagas Similares

🕒 Setembro 23

General Dynamics Information Technology

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Senior DevSecOps Engineer developing secure pipelines and software for GDIT’s PACER court-record systems. Supporting cloud, compliance, CI/CD, and resilient judicial access platforms.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 23

General Dynamics Information Technology

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Senior DevSecOps Engineer developing secure CI/CD systems for GDIT’s PACER court-record technology. Supporting cloud, containerized applications, compliance, and resilient software delivery.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 23

General Dynamics Information Technology

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Senior DevSecOps Engineer developing secure DevOps pipelines and PACER court-record systems. Supporting GDIT’s U.S. Judiciary technology mission with cloud, Linux, and application security.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 23

General Dynamics Information Technology

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Senior DevSecOps Engineer developing secure PACER court-record systems for GDIT. Managing DevSecOps pipelines, compliance, cloud technologies, and resilient software delivery.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 23

Akamai Technologies

5001 - 10000

🔒 Cibersegurança

Senior Site Reliability Engineer Lead automating Akamai’s distributed cloud and edge infrastructure. Driving reliability, incident response, performance tuning, and operational excellence for customer-facing services.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $121.400 - $218.600 / ano

💰 Post-IPO Equity em 2001-07

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório