Senior Site Reliability Engineer

Vaga não está no LinkedIn

🕒 Julho 16

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $160.000 - $200.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Epic Kids

Epic Kids

11 - 50 funcionários

📚 Educação

👥 B2C

📱 Mídia

Education • B2C • Media

Epic Kids é um serviço de assinatura digital que oferece uma biblioteca selecionada de eBooks infantis, audiolivros e vídeos educacionais. A plataforma proporciona a famílias e educadores acesso a milhares de títulos adequados para diversas idades de grandes editoras, incentivando a leitura, a descoberta e a alfabetização digital. A Epic Kids oferece planos para pais e acesso gratuito para educadores, posicionando-se como um recurso de mídia educacional para crianças.

Descrição

• Drive the reliability of Epic's infrastructure—set and track SLOs/SLIs, reduce toil, and engineer out recurring instability. • Build and operate the cloud infrastructure and container platform for high availability, scalability, and cost efficiency—including workload scheduling, autoscaling, networking, and graceful failure handling. • Maintain and improve CI/CD pipelines for fast, safe delivery across engineering teams. • Own and evolve the observability stack—metrics, logs, traces, dashboards, and alerts. • Manage infrastructure as code across the organization, with a focus on consistency, change safety, and reproducibility. • Own platform security practices—including secrets management, IAM policies, and network segmentation. • Support compliance-aware infrastructure practices—including vulnerability management, access reviews, audit-evidence flows, and incident-response readiness. • Participate in a frequent on-call rotation; drive incident response, blameless post-mortems, and follow-through on systemic fixes. • Partner with product and data engineering teams to troubleshoot platform issues and guide developers on infrastructure best practices.

🎯 Requisitos

• Bachelor's degree or higher in Computer Science, Software Engineering, or a related field. • 5+ years of experience in infrastructure, platform, DevOps, or a related engineering role, with a track record of measurably improving production reliability—including defining SLOs, reducing incident frequency or MTTR, and eliminating recurring failure modes. • Hands-on experience with Google Cloud Platform (GCP), including GCE, GCS, VPC, IAM, Cloud Monitoring, and related services. • Experience with Docker and Kubernetes (GKE), including containerizing workloads, Helm, and cluster fundamentals. • Experience with CI/CD pipelines such as GitHub Actions, ArgoCD, Jenkins, or similar tools. • Experience with an observability platform such as New Relic, including metrics, logging, alerting, and dashboards. • Proficiency with Terraform for managing infrastructure as code. • Scripting or programming experience with Python, Bash, or similar languages.

🏖️ Benefícios

• Join a mission-driven company making a meaningful impact on children's literacy and education. • Work alongside talented teammates in a collaborative, supportive, and global environment. • Enjoy the flexibility of a fully remote, U.S.-based position. • Help build and scale the infrastructure powering millions of young readers around the world.

Candidatar-se

Vagas Similares

🕒 Julho 16

Global Alliant Inc

51 - 200

💼 Consultoria

🏥 Saúde

📦 Logística

Fullstack DevSecOps Engineer developing enterprise applications on AWS. Collaborating in Agile environments with strong focus on secure coding practices.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 16

CACI International Inc

10.000+ funcionários

💼 Consultoria

🎖️ Defesa

CACI Cloud DevSecOps Engineer developing scalable software solutions for a cloud-native ecosystem. Collaborate with data scientists and DevSecOps engineers for analytics environment enhancements.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $105.100 - $231.100 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 16

NetImpact Strategies Inc.

201 - 500

💼 Consultoria

🏥 Saúde

🎖️ Defesa

AI/DevSecOps Installation Architect at NetImpact delivering innovative solutions for Federal Government. Collaborating with teams to integrate AI technologies for enhancing digital transformation.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $145.000 - $175.000 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 16

Akamai Technologies

5001 - 10000

🔒 Cibersegurança

Senior Site Reliability Engineer II at Akamai collaborating across software development, operations, and network teams. Responsible for developing standards and tooling for global platform stability.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $146.400 - $263.600 / ano

💰 Post-IPO Equity em 2001-07

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 16

Horizon3.ai

51 - 200

🔒 Cibersegurança

🤖 Inteligência Artificial

☁️ SaaS

Senior Engineering Manager responsible for building Site Reliability function at Horizon3.ai. Leading hiring and development of a team while ensuring operational excellence and cultural change across engineering.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $260.000 - $280.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório