Senior Site Reliability Engineer

🕒 Julho 20

🍂 Massachusetts – Remoto

info

💵 $146.400 - $263.600 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Akamai Technologies

Akamai Technologies

5001 - 10000 funcionários

🔒 Cibersegurança

💰 Post-IPO Equity em 2001-07

Cloud Computing • Cybersecurity • Content Delivery

A Akamai Technologies é um provedor líder de serviços em nuvem especializado em oferecer soluções de segurança, computação em nuvem e entrega de conteúdo. A empresa oferece uma gama de serviços, como segurança de API, proteção contra DDoS e otimização de desempenho para aplicativos web, garantindo experiências de usuário seguras e confiáveis. Com uma infraestrutura global robusta, a Akamai capacita empresas a otimizar sua presença digital, protegendo contra diversas ameaças cibernéticas e melhorando o desempenho de aplicativos.

Descrição

• Lead reliability workstreams for Akamai's serverless inference platform • Design SRE tooling and automation • Drive technical decisions • Mentor other SREs • Influence architecture decisions with product engineering teams • Shape SRE practices for AI inference workloads and GPU infrastructure at scale • Take ownership of observability strategy for the serverless inference platform • Design telemetry, dashboards, and alerts • Define SLO/SLI frameworks • Drive improvements when targets are missed • Build production-grade automation and tooling that reduces operational toil • Own incident management integration for inference workloads

🎯 Requisitos

• 8+ years of experience in SRE, infrastructure engineering, or platform engineering, working with large-scale distributed systems • Proven track record of defining SLO/SLI frameworks, building observability platforms, and running incident management processes at scale • Extensive Kubernetes and containerization experience at scale, including autoscaling, resource scheduling, and container orchestration for compute-intensive workloads • Experience building automation and tooling in Python or Go, with familiarity in CI/CD pipelines, deployment safety, and infrastructure-as-code • Ability to lead technical initiatives across teams, mentor other engineers, and drive complex reliability problems to resolution independently • Experience with or exposure to AI/ML infrastructure, model serving, or GPU workloads

🏖️ Benefícios

• healthcare • 401K savings plan • company holidays • vacation (in the form of PTO) • sick time • family friendly benefits including parental leave • employee assistance program including a focus on mental and financial wellness • industry-leading benefits

Candidatar-se

Vagas Similares

🕒 Julho 19

KITC, LLC (8(a) SDB)

11 - 50

🔒 Cibersegurança

🏛️ Governo

💼 Consultoria

Cloud DevSecOps Engineer III responsible for AWS cloud infrastructure and security automation. Collaborating on federal cybersecurity initiatives in a fully remote role.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 18

Envision Healthcare

10.000+ funcionários

🏥 Saúde

👥 B2C

🤝 B2B

DevOps Engineer IV for Envision's Engineering team. Collaborating on implementing advanced CI/CD pipelines and infrastructure as code.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 18

DraftKings Inc.

1001 - 5000

📣 Marketing

💼 Consultoria

📦 Logística

Senior Lead Database Reliability Engineer ensuring database reliability and operational excellence for a sports betting platform. Leading technical roadmap and optimizing performance across various systems.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $168.000 - $210.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 18

Stord

1001 - 5000

🍽️ Alimentos e Bebidas

💼 Consultoria

📣 Marketing

Senior Site Reliability Engineer responsible for infrastructure managing high-volume logistics operations on GCP. Collaborating to enhance reliability, automate processes, and improve monitoring practices.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 17

DraftKings Inc.

1001 - 5000

🎮 Jogos

⚽ Esportes

👥 B2C

Senior Lead Database Reliability Engineer enhancing reliability and scalability of database infrastructure at DraftKings, focusing on high availability and performance optimization.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $168.000 - $210.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório