Site Reliability Engineer

🕒 5 dias atrás

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $120.000 - $165.000 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of MyFitnessPal

MyFitnessPal

51 - 200 funcionários

Fundada em 2005

🏥 Saúde

🍽️ Alimentos e Bebidas

💼 Consultoria

💰 $18.000.000 Series A em 2013-08

Healthcare • Food & Beverage • Consulting

O MyFitnessPal é um aplicativo líder de acompanhamento de nutrição e fitness, desenvolvido para ajudar os usuários a alcançar seus objetivos de saúde e condicionamento físico. Oferece uma solução all‑in‑one para registrar a ingestão de alimentos, exercícios e calorias. Com mais de 18 milhões de alimentos em seu banco de dados, o MyFitnessPal permite acompanhar calorias, macros, micronutrientes e muito mais. O app integra-se a diversos dispositivos de fitness para sincronizar treinos, peso e outras métricas de saúde. Os insights personalizados de nutrição do MyFitnessPal orientam os usuários na construção de hábitos saudáveis e sustentáveis. Disponível nas versões gratuita e Premium, é elogiado pela interface amigável e pela eficácia em ajudar os usuários a alcançar objetivos de emagrecimento e condicionamento físico.

Descrição

• Own and evolve our SLI/SLO and error-budget frameworks, and use them to influence prioritization and product decisions • Lead incident response, drive postmortems, and turn findings into systemic fixes rather than one-off patches • Build and maintain observability across metrics, logs, and traces (Datadog), improving signal and reducing alert fatigue • Design and operate resilient, scalable infrastructure using Infrastructure as Code (Terraform) • Manage production Kubernetes and container workloads, including capacity planning and cloud-cost optimization • Own CI/CD pipelines and safe deployment strategies (canary, progressive rollout, fast rollback) • Own the security controls that live inside the delivery pipeline — integrating and tuning SAST, DAST, and SCA scanning (for example, in GitHub Actions) so issues surface while code is still in review • Implement and maintain policy-as-code (for example, OPA/Rego, Kyverno, or Conftest) to block unsafe infrastructure and Kubernetes changes at admission time • Drive vulnerability triage and remediation SLAs for pipeline- and infrastructure-level findings, prioritizing by real risk • Partner with our Security Engineer and the broader Security & Reliability disciplines — you own security in the pipeline and collaborate on the rest, rather than duplicating that function • Participate in and improve the on-call rotation; build the runbooks and automation that make on-call sustainable • Coach team members and engineers across the org on reliability patterns and operational best practices

🎯 Requisitos

• 5+ years in site reliability, platform, or infrastructure engineering • Strong programming skills for automation and tooling (Go, Python, Typescript or similar) • Deep, hands-on experience with a major cloud platform (AWS is a plus), Kubernetes, and Infrastructure as Code (Terraform is a plus) • Proven track record leading incident response and building SLO-driven reliability practices • Working fluency with observability tooling (Datadog is a plus) • Practical experience integrating security into CI/CD pipelines — SAST/DAST/SCA tooling, dependency scanning, or policy-as-code • Strong understanding of cloud security fundamentals (identity/IAM, least-privilege patterns, policy/guardrails, secrets management) • The judgment and communication skills to raise a security or reliability finding with a senior engineer and land it as a shared problem to solve, not a fight to win • Experience with policy-as-code frameworks (especially Kyverno, but tools like OPA/Rego or Conftest are also relevant) enforced at admission time is a plus • Exposure to regulated or compliance-driven environments (SOC 2, PCI DSS, HIPAA) is a plus • Chaos engineering or game-day experience is a plus • Experience supporting B2C/mobile backend environments with high traffic, rapid iteration, and strong reliability needs is a plus

🏖️ Benefícios

• healthcare • parental planning • mental health benefits • annual performance bonus • a 401(k) plan and match • responsible time off • monthly wellness and technology allowances

Candidatar-se

Vagas Similares

🕒 6 dias atrás

CXM

201 - 500

💸 Finanças

💳 Fintech

Application Site Reliability Engineer focusing on .NET/C# services reliability for trading systems. Collaborating with software engineers to enhance service resilience and operational excellence.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

NVIDIA

10.000+ funcionários

🏥 Saúde

🏭 Manufatura

🤖 Inteligência Artificial

DevOps Engineer supporting NVIDIA’s Rapids project for AI and data science initiatives. Collaborating with teams to ensure high-quality software releases and infrastructure maintenance.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

Global Enterprise Services, LLC (GES)

11 - 50

💼 Consultoria

📦 Logística

Reliability Engineer responsible for cloud platform performance and incident response, managing compliance. Requires strong technical expertise and 8 years of experience.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

Mirantis

501 - 1000

💼 Consultoria

🏥 Saúde

📦 Logística

Senior DevOps Engineer handling high-performance storage for AI platforms at Mirantis. Integrating and operating storage solutions within Kubernetes environments.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

NEC Software Solutions

5001 - 10000

🏥 Saúde

💼 Consultoria

📦 Logística

Senior DevOps Engineer managing cloud infrastructure and CI/CD for mission-critical applications. Seeking someone to collaborate with teams and maintain secure, scalable solutions.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório