Senior Engineering Manager – Site Reliability

🕒 Julho 16

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $260.000 - $280.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Horizon3.ai

Horizon3.ai

51 - 200 funcionários

Fundada em 2019

🔒 Cibersegurança

🤖 Inteligência Artificial

☁️ SaaS

Cybersecurity • Artificial Intelligence • SaaS

A plataforma NodeZero™ capacita sua organização a continuamente encontrar, corrigir e verificar sua superfície de ataque explorável. Reduza seu risco de segurança ao encontrar autonomamente fraquezas em sua rede, sabendo como priorizá-las e corrigi-las, e verificando imediatamente se suas correções funcionam. O NodeZero oferece pentests autônomos seguros para produção e outras operações de avaliação chave que escalam através de seus maiores ambientes internos, externos, em nuvem e em nuvem híbrida. Sem necessidade de agentes, sem código para escrever e sem consultores para contratar. Somos uma fusão de ex-operadores cibernéticos das Operações Especiais dos EUA, engenheiros de startups e praticantes de cibersegurança anteriormente frustrados. Estamos comprometidos em ajudar a resolver nossos problemas comuns de segurança: ferramentas de segurança ineficazes, falsos positivos resultando em fadiga de alerta, pontos cegos, cultura de segurança "para cumprir tabela", escassez de habilidades em cibersegurança e o longo tempo e custo de contratar consultores externos.

Descrição

• Build a SRE team, from scratch. Hire experienced site reliability staff and build a team of 4-6 in year one. • Professionalize incident management. Define and document incident processes and practices for your SRE team and for the application feature teams. • Drive incident professionalism and reliability culture across the engineering organization through training and process adoption. • Use design reviews, code reviews, and blameless retrospectives to drive a culture of quality and excellence in engineering. • Balance incident response while also executing on a roadmap of observability and reliability engineering initiatives. • Hire and directly manage site reliability engineers. • Responsible for recruiting, onboarding, mentoring, coaching, and developing your team. • Recognizing and retaining high performers. • Leading horizontally with peer management & senior leaders.

🎯 Requisitos

• Demonstrated experience leading hiring and growing SRE or Infrastructure teams • Experience leading or building SRE functions, including incident management processes, on-call programs, SLO/SLA definition, and operational runbooks • Previous career experience as a Site Reliability Engineer • Deep hands-on experience with observability: application performance management, logs and traces, and golden signals and service-specific metrics • Experience in selecting and deploying incident management tooling (e.g., PagerDuty, FireHydrant,etc.) • Strong working knowledge of at least one major cloud provider (AWS, GCP, or Azure)

🏖️ Benefícios

• Health, vision & dental insurance for you and your family • Flexible vacation policy • Generous parental leave • Equity package in the form of stock options

Candidatar-se

Vagas Similares

🕒 Julho 16

Accelerant

201 - 500

🛡️ Seguros

☁️ SaaS

🤝 B2B

Senior SRE driving reliability and observability across financial data platform at Accelerant. Partnering with engineering to enhance monitoring, metrics, and incident management processes.

🇺🇸 Estados Unidos – Remoto (EUA)

💰 $150.000.000 Private Equity Round - Accelerant em 2023-06

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 15

Empower AI

501 - 1000

🎖️ Defesa

🏥 Saúde

📦 Logística

Sr. DevOps Engineer architecting scalable infrastructure and automating solutions for USCIS in a fully remote role. Mentoring engineers and supporting critical systems with complex challenges.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 15

Encoura

51 - 200

💼 Consultoria

📣 Marketing

📚 Educação

Azure DevOps Engineer responsible for ensuring reliability of large-scale production systems at Encoura. Leading CI/CD initiatives and collaborating with engineering teams on cloud infrastructure.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $116.000 - $128.800 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 15

Vytalize Health

201 - 500

🏥 Saúde

☁️ SaaS

⚕️ Seguro de Saúde

Data Reliability Engineer ensuring operational health of healthcare data pipelines at Vytalize Health. Focused on data quality, compliance, and collaboration across teams.

🇺🇸 Estados Unidos – Remoto (EUA)

💰 $100.000.000 Series C - Vytalize Health em 2023-02

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 15

11:11 SYSTEMS

201 - 500

💼 Consultoria

🏥 Saúde

📦 Logística

Infrastructure Deployment Engineer managing deployment projects across global data centers. Leading cross-functional teams to ensure timely and standardized execution of infrastructure projects.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $94.000 - $130.500 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório