Staff Site Reliability Engineer

🕒 Agosto 13

🏄 California – Remoto

infoinfo

💵 $240.000 - $300.000 / ano

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

👻 Score fantasma 1%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Skydio

Skydio

501 - 1000 funcionários

Fundada em 2014

🎖️ Defesa

🏭 Manufatura

📦 Logística

💰 $170.000.000 Series E - Skydio em 2024-11

Defense • Manufacturing • Logistics

A Skydio é um fabricante de sistemas de drones autônomos que combina inteligência artificial avançada a bordo, sensores e software em nuvem para automatizar voos para missões de inspeção, segurança, segurança pública e mapeamento. Sua família de produtos (incluindo o X10, X10D, R10, estações de acoplamento e software como Skydio Autonomy e DFR Command) é projetada para rápida conscientização situacional, inspeções automatizadas, segurança de locais e implantações de Drone como Primeira Resposta para clientes governamentais, utilitários e empresariais. A Skydio oferece hardware, software e serviços integrados para viabilizar operações mais seguras, rápidas e autônomas em ambientes desafiadores.

Descrição

• Build, operate, and troubleshoot production Kubernetes/EKS clusters • Perform Kubernetes upgrades, node rollouts, and cluster maintenance • Build and manage AWS infrastructure including VPCs, networking, subnets, load balancers, IAM, EKS, databases, and storage • Define and maintain infrastructure using Terraform • Build and operate CI/CD and deployment infrastructure • Troubleshoot production issues across Kubernetes, AWS, Linux, networking, and databases • Build monitoring, alerting, and observability for critical infrastructure • Participate in on-call rotations and respond to production incidents • Identify and solve infrastructure scaling and reliability problems • Automate operational work using Python, Go, or similar languages • Help expand infrastructure across new regions and deployment environments

🎯 Requisitos

• 8+ years of experience as a Site Reliability Engineer, Platform Engineer, DevOps, Production Engineer, or equivalent infrastructure role • Strong hands-on experience operating Kubernetes • Experience managing Kubernetes/EKS upgrades and production clusters • Strong AWS fundamentals, including VPCs, public/private subnets, networking, load balancers, EKS, IAM, and databases • Production experience with Terraform or similar infrastructure-as-code tooling • Experience owning or maintaining CI/CD and deployment systems such as Argo CD, Spinnaker, GitHub Actions, GitLab CI/CD, or Jenkins • Experience diagnosing production infrastructure and networking problems • Experience solving meaningful scaling or reliability challenges • U.S. person status verification and ability to access controlled or restricted information as required • Bonus: Helm and GitOps experience • Bonus: Datadog or similar observability tooling • Bonus: PostgreSQL/database operations experience • Bonus: Multi-region infrastructure experience • Bonus: On-premises or disconnected deployment experience • Bonus: Streaming or high-throughput distributed systems experience

🏖️ Benefícios

• Competitive base salary • Equity in the form of stock options • Comprehensive benefits package • Relocation assistance may be provided for eligible roles • Company group health insurance plans • Paid vacation time • Sick leave • Holiday pay • 401K savings plan

Candidatar-se

Vagas Similares

🕒 Agosto 12

AlphaSense

1001 - 5000

💼 Consultoria

🏥 Saúde

📣 Marketing

Principal engineer architecting scalable CI/CD and Kubernetes delivery systems for AlphaSense, an AI-powered market intelligence platform. Defining progressive delivery standards and developer self-service across global engineering teams.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $246.000 - $339.000 / ano

💰 Debt Financing em 2022-06

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 11

Inizio Evoke

1001 - 5000

🏥 Saúde

💼 Consultoria

📣 Marketing

Director, DevOps operating AWS infrastructure for Inizio Evoke’s agentic AI platform. Automating deployments, ensuring reliability, and leading security, compliance, and release operations remotely.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $100.000 - $145.000 / ano

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 11

Hexion Inc.

1001 - 5000

🚘 Automotivo

🏗️ Construção

🏭 Manufatura

Reliability Engineer improving asset performance across Hexion’s North American manufacturing plants. Leading failure elimination, maintenance optimization, and cross-site reliability standardization.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 11

Vontier

5001 - 10000

🚘 Automotivo

⚡ Energia

🔧 Hardware

Hardware Reliability Engineer leading reliability planning, validation, and failure analysis for Gilbarco Veeder-Root fueling equipment. Improving durability, serviceability, and field performance across complex electromechanical products.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

Ray

🕒 Agosto 11

Hexion Inc.

1001 - 5000

🚘 Automotivo

🏗️ Construção

🏭 Manufatura

Reliability Engineer reducing downtime and improving asset performance across Hexion’s North American manufacturing plants. Leading RCA, maintenance strategy, CMMS execution, KPI analysis, and cross-site reliability standardization.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório