Senior Site Reliability Engineer – Infra Ops

🕒 6 dias atrás

🏄 California – Remoto

info

💵 $152.500 - $205.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Circle

Circle

501 - 1000 funcionários

💳 Fintech

₿ Cripto

🌐 Web 3

Fintech • Crypto • Web 3

A Circle é uma empresa de tecnologia financeira especializada em serviços financeiros baseados em blockchain. Ela oferece soluções como o USDC (uma stablecoin de dólar digital), pagamentos transfronteiriços e ofertas para os mercados de capitais cripto. A plataforma da Circle é projetada para empresas e desenvolvedores, permitindo que aproveitem o alcance global da blockchain por meio de recursos como carteiras programáveis, contratos inteligentes e APIs. A Circle garante transparência ao publicar atestações mensais de reservas e oferece serviços que são compatíveis com uma ampla gama de plataformas de blockchain. Seu objetivo é criar uma plataforma aberta e eficiente para dinheiro programável.

Descrição

• Design, build, and operate secure, highly available, scalable Kubernetes platforms across hybrid and public-cloud environments • Build reusable infrastructure-as-code modules and automated delivery workflows with Terraform • Develop backend services, internal tools, and operational automation in Go, Python, or JavaScript/TypeScript • Partner with engineering and product teams to translate workload requirements into reliable, secure, performant, cost-effective technical designs • Improve production lifecycle through CI/CD, deployment automation, progressive delivery, and operational ownership • Define observability practices across metrics, logs, traces, alerting, and dashboards • Participate in on-call, lead incident response, perform root-cause analysis, and drive blameless postmortems and corrective actions • Establish reliability targets using SLIs, SLOs, error budgets, capacity planning, disaster-recovery testing, and resilience improvements • Embed security and compliance into platform operations and partner with Security • Apply AI-assisted and data-driven operational techniques to improve detection, reduce alert noise, accelerate root-cause analysis, and automate workflows • Conduct code reviews, documentation, knowledge sharing, and mentorship • Mentor and support team growth

🎯 Requisitos

• 5+ years of experience in Site Reliability Engineering, DevOps, Infrastructure Engineering, or closely related software engineering supporting production systems • Deep hands-on Kubernetes expertise, including designing, operating, securing, and troubleshooting production clusters and containerized workloads at scale • Strong Terraform experience, including reusable modules, state and environment management, and automated infrastructure delivery workflows • Production software-development experience in Go, Python, or JavaScript/TypeScript • Experience improving reliability, performance, scalability, or cost efficiency of distributed systems in production • Experience with cloud infrastructure and networking concepts including IAM, DNS, load balancing, routing, service networking, and secure connectivity • Strong observability and troubleshooting skills using metrics, logs, traces, alerting, and incident data • Experience with SLIs, SLOs, error budgets, incident management, postmortems, and disaster recovery • Familiarity with CI/CD, GitOps or deployment automation, and canary or blue-green deployments • Security-minded infrastructure approach and experience partnering with Security and engineering teams in regulated or high-availability environments • Clear written and verbal communication, strong ownership, and judgment balancing speed, risk, and operational excellence • Experience applying AI-assisted tooling is a plus

🏖️ Benefícios

• Flexible work environment • Inclusive work environment • Equal opportunity employer • Interview accommodations or assistance for candidates with disabilities • Compensation package including base pay

Candidatar-se

Vagas Similares

🕒 6 dias atrás

The Home Depot

10.000+ funcionários

🏗️ Construção

📦 Logística

🛒 Varejo

Software Engineering Manager improving reliability, security, and performance for Home Depot’s retail store systems. Leading SRE strategy, incidents, cloud infrastructure, automation, and engineering talent development.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $140.000 - $240.000 / ano

💰 Debt Financing em 2007-07

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

Sporttrade

11 - 50

💼 Consultoria

📣 Marketing

🎲 Jogos de Azar

Site Reliability Engineer operating Sporttrade’s regulated sports betting exchange across cloud and datacenter infrastructure. Automating operations, improving observability, and leading incident response for a live marketplace.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $150.000 - $170.000 / ano

💰 $36.000.000 Funding Round em 2021-06

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

NVIDIA

10.000+ funcionários

🏥 Saúde

🏭 Manufatura

🤖 Inteligência Artificial

AI Tools Engineer building LLM and AI/ML systems for NVIDIA’s global GeForce NOW service. Automating incident root-cause analysis and predicting operational trends from production data.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

SitusAMC

5001 - 10000

💼 Consultoria

📦 Logística

🏠 Imobiliário

Site Reliability Engineer operating AWS cloud infrastructure for SitusAMC’s real estate technology solutions. Improving reliability, automation, observability, security, and application migrations.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $95.000 - $135.000 / ano

💰 Private equity em 2020-05

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

GE Vernova

10.000+ funcionários

💼 Consultoria

📦 Logística

🏭 Manufatura

Senior Reliability Engineer improving embedded protection, control, and software products for GE Vernova’s decarbonization mission. Driving testing, field analytics, grid reliability, and cybersecurity compliance.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $162.900 - $244.300 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório