Principal Site Reliability Engineer, SRE

Vaga não está no LinkedIn

🕒 Junho 11

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of SoluStaff

SoluStaff

51 - 200 funcionários

🏥 Saúde

🎖️ Defesa

🏭 Manufatura

Healthcare • Defense • Manufacturing

A Symmetrio é uma empresa completa de recrutamento, seleção e consultoria com décadas de experiência em várias indústrias de rápido crescimento. Eles são especializados em colocação permanente, contratos temporários com possibilidade de efetivação e aumento de quadro de funcionários, focando na alocação de talentos alinhados com os objetivos e culturas dos clientes. Symmetrio oferece soluções de recrutamento sob medida e serviços de consultoria em setores como ciências da vida, tecnologia da informação, engenharia, dispositivos médicos, soluções logísticas, manufatura e automação predial. Sua equipe de especialistas em aquisição de talentos está comprometida em compreender as necessidades organizacionais dos clientes e fornecer profissionais especializados para enfrentar esses desafios. Com forte ênfase na confiança, compreensão e colaboração, a Symmetrio visa otimizar operações e impulsionar a inovação e excelência para seus clientes.

Descrição

• Serve as the primary technical owner for production reliability across U.S. customer environments. • Investigate and resolve complex issues spanning web applications, APIs, backend services, data pipelines, cloud infrastructure, and customer integrations. • Lead production incident response efforts, coordinating cross-functional teams to restore service and minimize customer impact. • Perform root cause analysis and drive corrective actions that improve long-term system stability and resilience. • Partner with software engineering and platform teams to identify recurring reliability risks and implement sustainable solutions. • Design, configure, and validate secure customer connectivity solutions including Site-to-Site VPNs, Transit Gateway integrations, routing configurations, and secure network paths. • Support customer onboarding initiatives by troubleshooting connectivity challenges and ensuring consistent implementation processes. • Enhance platform observability through improvements in monitoring, logging, alerting, tracing, and operational dashboards. • Contribute to CI/CD, infrastructure automation, and deployment processes that improve release safety and operational consistency. • Develop operational tooling that supports incident response, troubleshooting, onboarding, and system monitoring activities. • Collaborate with engineering leadership to improve cloud architecture, scalability, security, and operational readiness. • Partner with customer-facing teams to communicate technical issues, remediation plans, and reliability improvements in a clear and effective manner. • Support compliance, security, and risk management initiatives within highly regulated healthcare environments.

🎯 Requisitos

• 6+ years of hands-on experience supporting and managing AWS-based production environments. • 4+ years of experience supporting web applications and backend services (Python/Django experience strongly preferred). • Experience with AWS networking technologies including VPCs, Site-to-Site VPNs, Transit Gateways, routing, NAT gateways, and security groups. • Strong experience with Terraform and infrastructure-as-code deployment practices. • Experience with containerized environments including ECS, Fargate, Kubernetes, or similar technologies. • Experience building and supporting CI/CD pipelines and release automation processes. • Familiarity with monitoring and observability platforms such as Datadog, CloudWatch, Sentry, Grafana, or similar tools. • Experience leading production incidents, outage management, and root cause analysis initiatives. • Exposure to Windows Server environments, Active Directory, Kerberos, and enterprise infrastructure concepts is preferred. • Healthcare technology, healthcare SaaS, clinical software, or other regulated industry experience is highly preferred. • Bachelor’s degree in Computer Science, Engineering, Information Technology, or a related technical field preferred.

🏖️ Benefícios

• Health Care Plan (Medical, Dental & Vision) • Retirement Plan (401k, IRA) • Paid Time Off (Vacation, Sick & Public Holidays)

Candidatar-se

Vagas Similares

🕒 Junho 9

Coinbase

1001 - 5000

💼 Consultoria

₿ Cripto

💸 Finanças

Staff Site Reliability Engineer driving AI transformation by ensuring reliability and automation at Coinbase. Collaborating with infrastructure teams and leading critical incident responses to maintain service excellence.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $218.025 - $256.500 / ano

💰 $21.400.000 Post-IPO Equity em 2022-11

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Junho 8

MKS2 Technologies

201 - 500

💼 Consultoria

🏥 Saúde

📦 Logística

Site Reliability Systems Engineer working with monitoring tools to enhance VA's infrastructure reliability. Collaborating across teams to resolve outages and improve service quality for veterans.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Junho 4

Headspace

501 - 1000

🏥 Saúde

🧘 Bem-estar

⚕️ Seguro de Saúde

Principal DevOps Engineer at Headspace ensuring platform reliability for 65 million users. Lead cloud strategies and mentor engineering teams to deliver innovative features.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Junho 4

Honor

501 - 1000

🏥 Saúde

💼 Consultoria

📦 Logística

Platform Engineer designing, implementing, and maintaining scalable infrastructure for Honor’s Care Platform. Requires extensive experience in cloud services, containerization, and CI/CD pipelines.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $194.000 - $220.000 / ano

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Junho 2

Agilent Technologies

10.000+ funcionários

🍽️ Alimentos e Bebidas

🏥 Saúde

💼 Consultoria

DevOps Software Engineer designing and maintaining CI/CD pipelines and cloud infrastructure for Agilent’s CrossLab Connect team. Supporting application development and optimizing deployment processes.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $143.760 - $224.625 / ano

💰 $500.000.000 Post-IPO Debt em 2019-09

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório