Engineering Manager, Reliability Engineering – EDA Infrastructure

🕒 Setembro 22

🏄 California, Massachusetts, +2 estados a mais – Remoto

infoinfo

💵 $224.000 - $431.250 / ano

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

👻 Score fantasma 1%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of NVIDIA

NVIDIA

10.000+ funcionários

Fundada em 1993

🏥 Saúde

🏭 Manufatura

🤖 Inteligência Artificial

Healthcare • Manufacturing • Artificial Intelligence

A NVIDIA é uma empresa de tecnologia líder, especializada em computação acelerada e inteligência artificial. A companhia é pioneira em avanços em unidades de processamento gráfico (GPUs), computação em nuvem, data centers e realidade virtual, com foco nos setores de games, automotivo, saúde e robótica. As inovações da empresa, como o NVIDIA Omniverse, transformam processos digitais tradicionais ao viabilizar simulações de alta fidelidade e tarefas de renderização. Suas aplicações abrangem diversos setores, desde veículos autônomos com o NVIDIA DRIVE até soluções de saúde com o NVIDIA Clara, além de análises e fluxos de trabalho impulsionados por IA.

Descrição

• Lead a team and own the roadmap for operational processes and platforms, from requirements and delivery through adoption and results • Set technical direction, prioritize work, and guide execution across engineering and operational disciplines • Partner with infrastructure, product, and security teams to establish consistent practices for incident response, maintenance, on-call, issue management, and customer-serving readiness • Hire and develop engineers and technical leads, building a team with clear ownership and accountability • Align priorities across teams, communicate progress and risks, and provide technical leadership during major incidents • Improve reliability and reduce manual work through automation, AI, and lessons from operational events • Build and operate systems supporting chip development

🎯 Requisitos

• BS degree or equivalent experience • 10+ overall years of software engineering or related experience • 5+ years of engineering leadership managing teams or complex technical programs • Knowledge of operational processes and supporting platforms, including roadmap, delivery, adoption, and improvement • Strong technical judgment in software architecture, platform integration, and engineering tradeoffs • Clear communication with engineers, cross-functional partners, and executive stakeholders • A record of developing engineers, growing teams, and delivering results under pressure • Established readiness standards covering service ownership, support coverage, and reliability objectives • Experience building, integrating, and scaling platforms pertaining to incident management, maintenance, customer experience management, on-call, and production readiness • Experience applying AI or LLMs to improve triage, knowledge retrieval, incident analysis, or automation • Experience supporting EDA, large-scale compute, or hybrid infrastructure with complex dependencies and demanding availability requirements

🏖️ Benefícios

• Equity • Benefits

Candidatar-se

Vagas Similares

🕒 Setembro 22

Bellese Technologies

51 - 200

🏥 Saúde

💼 Consultoria

⚕️ Seguro de Saúde

Senior DevOps Engineer building secure AWS infrastructure, CI/CD pipelines, and observability tools. Supporting Bellese’s mission-driven civic healthcare technology solutions.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $128.700 - $153.400 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 22

Entarian

1001 - 5000

🚀 Aeroespacial

🎖️ Defesa

🏛️ Governo

DevSecOps Engineer building secure cloud platforms and automation for Entarian’s U.S. Navy mission systems. Developing CI/CD, Terraform, Kubernetes, and compliance validations.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 22

Upstart

1001 - 5000

🚘 Automotivo

💼 Consultoria

🏥 Saúde

Site Reliability Software Engineer building observability, automation, and resiliency systems for Upstart’s AI lending marketplace. Improving production reliability and incident response across engineering.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 22

Experian

10.000+ funcionários

💼 Consultoria

📣 Marketing

📦 Logística

Especialista em SRE responsável por garantir a confiabilidade, a observabilidade e a resiliência dos produtos de Identidade e Fraude da Experian. Automação de operações críticas em ambientes distribuídos de grande escala.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Setembro 22

ExpertVoice

51 - 200

📣 Marketing

🛒 Varejo

🛍️ Comércio Eletrônico

Site Reliability Engineer IV setting technical direction for ExpertVoice’s platform serving leading consumer brands. Owning reliability, automation, CI/CD, architecture, and incident response at scale.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $170.000 - $185.000 / ano

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório