Senior Site Reliability Engineer, SRE

🕒 4 dias atrás

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $192.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of LeoLabs

LeoLabs

51 - 200 funcionários

Fundada em 2016

🏭 Manufatura

📦 Logística

🎖️ Defesa

Manufacturing • Logistics • Defense

A LeoLabs é um provedor comercial de inteligência orbital persistente e serviços de conscientização do domínio espacial. A empresa opera uma rede de radares terrestres, rapidamente implantáveis, e uma plataforma baseada em nuvem habilitada por IA para rastrear e catalogar objetos em órbita baixa da Terra, fornecer alertas de conjunção em tempo real, avaliações de ameaças, suporte a lançamentos e dados de gerenciamento de tráfego espacial para clientes comerciais e governamentais. A LeoLabs combina hardware de radar, conjuntos de dados autoritativos e análises SaaS para ajudar operadores a proteger ativos, evitar colisões e gerenciar operações de lançamento e em órbita.

Descrição

• Design, implement, and maintain scalable and reliable systems • Set up monitoring tools and create incident response plans to identify and resolve issues • Implement preventative measures to improve reliability • Develop and maintain scripts and automation tools for deployment, monitoring, and system health checks • Analyze system capacity and performance metrics to forecast future needs and implement scaling solutions • Collaborate with development teams to enhance product reliability and streamline deployment • Create and maintain documentation for system architecture, processes, and incident reports • Participate in on-call rotations to provide 24/7 support for critical systems • Implement and enforce security best practices across all systems and ensure compliance with industry standards • Independently deploy infrastructure changes using Infrastructure as Code • Identify reliability risks and recommend improvements • Improve dashboards, alerts, and operational runbooks • Improve deployment pipelines, infrastructure provisioning, or self-service capabilities • Optimize infrastructure utilization and cloud costs without compromising reliability • Drive automation to reduce operational toil and improve deployment reliability • Lead cross-functional initiatives to improve availability, scalability, and operational efficiency • Advise on site reliability in new product developments and platform evolution • Mentor junior engineers and foster the development culture

🎯 Requisitos

• Bachelor’s degree in Computer Science, Engineering, or a related field, or equivalent work experience • 5+ years of experience in Site Reliability Engineering, DevOps, or a related role • Proficiency in a scripting or programming language such as Python or Go • Experience with cloud services including AWS or Azure • Proficiency with containerization technologies including Docker, Kubernetes, or ECS • Proficiency in configuration management tools including Terraform, Atlantis, or Terragrunt • Familiarity with CI/CD tools including GitHub Actions, AWS CodeBuild, or CircleCI • Experience with monitoring tools including Grafana or Datadog • Familiarity with database technologies including RDS, Aurora, or PostgreSQL • Experience with large-scale distributed systems and microservices architecture • Strong analytical and problem-solving skills for troubleshooting complex systems • Excellent verbal and written communication skills • Ability to obtain a U.S. personnel security clearance • Active TS/SCI clearance preferred

🏖️ Benefícios

• Global workforce: flexible remote/hybrid opportunities • Work on complex, meaningful missions with real-world impact • Unlimited paid time off for most roles • Competitive salary and equity packages • Comprehensive health, dental, and vision coverage • Access to the forefront of commercial space operations and defense innovation • Additional compensation opportunities including bonus and equity

Candidatar-se

Vagas Similares

🕒 4 dias atrás

PostHog

11 - 50

💼 Consultoria

📣 Marketing

📦 Logística

Site Reliability Engineer scaling PostHog’s open-source product analytics platform on AWS. Automating Kubernetes infrastructure, multi-account networking, reliability, and incident response.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 5 dias atrás

ArangoDB

51 - 200

🏥 Saúde

📦 Logística

💼 Consultoria

Site Reliability Engineer scaling Arango’s cloud-native contextual AI data platform. Automating Kubernetes, AWS, and Google Cloud infrastructure with Golang, observability, and resilient production operations.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 5 dias atrás

CampMinder

51 - 200

💼 Consultoria

🏥 Saúde

🏨 Hospitalidade

Senior DevSecOps Engineer securing Campminder’s software for summer camps. Hardening cloud infrastructure, embedding security in CI/CD, and leading compliance and threat-remediation work.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $180.000 - $200.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 5 dias atrás

MeridianLink

501 - 1000

💳 Fintech

🏦 Bancário

☁️ SaaS

Senior SRE owning reliability, observability, and scalability for MeridianLink’s financial SaaS applications. Designing resilient AWS/Azure infrastructure, automation, incident response, and security practices.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $104.148 - $177.600 / ano

💰 $485.000.000 Post-IPO Debt em 2021-11

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 5 dias atrás

eFinancial

201 - 500

🏥 Saúde

💼 Consultoria

🛡️ Seguros

DevOps Team Lead building AWS infrastructure, CI/CD pipelines, and shared engineering platforms for a life insurance provider. Coaching engineers and improving deployment reliability and automation.

🗣️🇺🇸🇬🇧 Inglês obrigatório