Senior Site Reliability Engineer

🕒 4 dias atrás

🌐 Estados Unidos, Canadá – Remoto

info

💵 $110.000 - $130.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of EverCommerce

EverCommerce

1001 - 5000 funcionários

Fundada em 2016

🏥 Saúde

💼 Consultoria

📦 Logística

💰 Private Equity Round em 2019-07

Healthcare • Consulting • Logistics

A EverCommerce é a principal plataforma de comércio de serviços, fornecendo soluções SaaS integradas e personalizadas verticalmente para mais de 500. 000 empresas globais baseadas em serviços. Fundada em 2016, a EverCommerce oferece soluções de software que ajudam as empresas a promover seus serviços, otimizar as operações diárias e melhorar o engajamento dos clientes. A empresa se especializa em impulsionar a economia de serviços com transformação digital em vários setores, incluindo Serviços Residenciais e de Campo, Serviços de Saúde e Fitness & Bem-Estar. A tecnologia da EverCommerce visa acelerar o crescimento, melhorar as operações e aumentar a retenção para pequenas e médias empresas, transformando a maneira como elas interagem com os clientes por meio de aplicativos digitais e móveis modernos.

Descrição

• Maintain uptime, reliability, and performance for production SaaS environments across AWS, colocation, and hosted infrastructure platforms • Independently support Windows and Linux infrastructure, virtualization platforms, storage systems, and networking components • Lead infrastructure modernization and operational automation initiatives • Troubleshoot complex infrastructure, application connectivity, and production incidents; lead root cause analysis and recommend corrective actions • Improve monitoring, alerting, and operational visibility across infrastructure platforms • Collaborate with security teams and technology leaders on SOX, PCI, and HIPAA compliance initiatives • Lead vulnerability remediation and infrastructure lifecycle maintenance • Develop and maintain technical documentation, operational procedures, and infrastructure standards • Collaborate with application teams and vendors to support infrastructure hosting production database systems • Lead medium-sized infrastructure projects from planning through implementation • Participate in disaster recovery testing, recovery planning, and continuous operational improvement • Evaluate emerging technologies and recommend improvements to infrastructure operations

🎯 Requisitos

• 8 years of systems, infrastructure, or cloud engineering experience supporting production environments • Experience administering Windows Server and Linux systems • Experience supporting infrastructure in AWS environments • Experience with enterprise virtualization platforms • Experience designing or implementing infrastructure automation using PowerShell, Bash, Python, or similar scripting languages • Experience leading technical investigations and root cause analysis for production issues • Understanding of networking fundamentals, firewalls, backup and recovery processes, and operational resiliency • Familiarity with enterprise monitoring platforms and operational troubleshooting • Familiarity with operational support for production database infrastructure, including backup validation, connectivity troubleshooting, and recovery operations • Strong communication, collaboration, and technical documentation skills • Ability to independently manage complex production infrastructure with minimal supervision • Experience with Terraform or Infrastructure as Code preferred • Experience with Ansible, Puppet, or Chef preferred • Experience supporting PCI-DSS, HIPAA, or SOX-regulated environments preferred • Experience implementing infrastructure modernization or cloud migration projects preferred • Experience supporting highly available SaaS or public-facing systems preferred • Experience developing disaster recovery plans and participating in recovery testing preferred • Experience creating engineering standards, operational documentation, and infrastructure diagrams preferred • Must be eligible to work without sponsorship

🏖️ Benefícios

• Flexible work environment • Robust health and wellness benefits • 401(k) with company match • Flexible and generous (FTO) time off • Employee Stock Purchase Program

Candidatar-se

Vagas Similares

🕒 4 dias atrás

Merative

1001 - 5000

🏥 Saúde

💼 Consultoria

⚕️ Seguro de Saúde

DevOps Engineer building Azure infrastructure automation, CI/CD pipelines, and operational tooling for Merative’s health and social-care software. Improving platform security, reliability, onboarding, and cloud cost efficiency.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 4 dias atrás

Vultr

201 - 500

🤖 Inteligência Artificial

🤝 B2B

🔧 Hardware

Network DevOps Engineer automating RDMA Ethernet fabrics for Vultr, a global cloud infrastructure provider. Building network automation, telemetry pipelines, and GPU/AI interconnects.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $90.000 - $130.000 / ano

💰 $329.000.000 Debt Financing - Vultr em 2025-06

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 4 dias atrás

Capgemini

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Enterprise AI practice leader at Capgemini, a global technology transformation partner. Driving AI strategy, governance, delivery, growth, and organizational transformation for enterprise clients.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 4 dias atrás

LeoLabs

51 - 200

🏭 Manufatura

📦 Logística

🎖️ Defesa

Senior SRE ensuring reliable cloud infrastructure for LeoLabs’ space-security platform. Automating deployments, monitoring systems, responding to incidents, and improving scalability and security.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 4 dias atrás

PostHog

11 - 50

💼 Consultoria

📣 Marketing

📦 Logística

Site Reliability Engineer scaling PostHog’s open-source product analytics platform on AWS. Automating Kubernetes infrastructure, multi-account networking, reliability, and incident response.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório