Senior Network Reliability Engineer

🕒 Agosto 11

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $135.000 - $190.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

👻 Score fantasma 9%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Group 1001

Group 1001

501 - 1000 funcionários

💼 Consultoria

🏥 Saúde

💸 Finanças

Consulting • Healthcare • Finance

A Group 1001 é um coletivo focado em capacitar empresas e comunidades por meio de soluções financeiras inovadoras e parcerias estratégicas. A empresa oferece produtos de seguro e anuidades simples e acessíveis, desenhados para ajudar indivíduos a gerenciar e aumentar suas economias. Sua plataforma de investimentos online oferece aos usuários um meio digital de controlar seu futuro financeiro. A Group 1001 também investe em parcerias que aprimoram o desenvolvimento comunitário por meio da educação e esportes. Com uma cultura voltada para a tecnologia, eles estão transformando a indústria de seguros e ajudando comunidades a prosperar.

Descrição

• Define network-platform SLOs and error budgets, using them to gate changes • Lead postmortems focused on permanent remediation • Move network state into declarative, version-controlled code using Terraform or Pulumi, Ansible, Python, and Infra CI/CD • Build network policy as intent and implement Policy as Code controls • Design, deploy, and manage network infrastructure through Infrastructure as Code • Operate and extend the multi-account AWS Landing Zone, including Cloud WAN, Transit Gateway, IPAM, private DNS, and telemetry pipelines • Build platform abstractions for correctly onboarding accounts and services • Engineer Kubernetes networking, service mesh, eBPF observability, and cloud-tier identity integrations • Build structured alerts, runbooks, and operator and end-user monitoring dashboards • Provide technical guidance to junior engineers and mentor the team • Maintain and configure routers, switches, and firewalls at data centers and offices when required • Serve as an escalation point for network incidents and troubleshoot through root-cause analysis • Author runbooks and SOPs and package routine work for L1/L2 handoff • Coordinate reliability practices across Data Platforms, NOC/SOC, and Cyber Security

🎯 Requisitos

• Deep understanding of TCP/IP, BGP, OSPF, VPNs, and SD-WAN architecture • Proven production experience with Terraform state management and modules, Ansible playbooks and roles, or similar • Proficiency in Python for automation and API interaction, or similar • Hands-on experience with Cloudflare, Zscaler, and/or enterprise firewalls • Experience configuring monitoring tools such as Datadog, Prometheus, or Grafana for meaningful alerts and dashboards • Service mesh experience with Istio, Linkerd, Consul Connect, or Cilium (nice to have) • eBPF-based observability experience with Hubble or Pixie (nice to have) • AWS multi-account landing-zone tooling experience, such as AFT or Control Tower (nice to have) • Policy as Code experience with OPA/Rego, Sentinel, or Cilium NetworkPolicy (nice to have) • Strong belief in documentation-first practices • Mindset focused on automating repetitive tasks and reducing toil • Willingness to handle physical hardware tasks when required while maintaining a software-centric engineering mindset

🏖️ Benefícios

• Comprehensive health, dental, and vision insurance plan options • Basic and Supplemental Life Insurance • Short- and Long-Term Disability • Employee Assistance Program • Wellness programs • 401K plan with matching contributions by the Company • Supportive work environment where employee differences are valued

Candidatar-se

Vagas Similares

🕒 Agosto 11

Hexion Inc.

1001 - 5000

🚘 Automotivo

🏗️ Construção

🏭 Manufatura

Reliability Engineer improving asset performance across Hexion’s North American manufacturing plants. Leading failure elimination, maintenance optimization, and cross-site reliability standardization.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 11

Vontier

5001 - 10000

🚘 Automotivo

⚡ Energia

🔧 Hardware

Hardware Reliability Engineer leading reliability planning, validation, and failure analysis for Gilbarco Veeder-Root fueling equipment. Improving durability, serviceability, and field performance across complex electromechanical products.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

Ray

🕒 Agosto 11

Hexion Inc.

1001 - 5000

🚘 Automotivo

🏗️ Construção

🏭 Manufatura

Reliability Engineer reducing downtime and improving asset performance across Hexion’s North American manufacturing plants. Leading RCA, maintenance strategy, CMMS execution, KPI analysis, and cross-site reliability standardization.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 10

PhoenixTeam

51 - 200

💳 Fintech

🏠 Imobiliário

🤖 Inteligência Artificial

DevSecOps Engineer building high-volume Salesforce, AWS, and VA Notify integrations for PhoenixTeam’s federal Veterans Affairs solutions. Assessing architecture, security, scalability, and delivery pipelines.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 10

Entarian

1001 - 5000

🚀 Aeroespacial

🎖️ Defesa

🏛️ Governo

DevSecOps Engineer automating secure cloud infrastructure and CI/CD platforms for Entarian’s U.S. Navy missions. Supporting Kubernetes, Terraform, cloud networking, compliance validation, and infrastructure testing.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório