Site Reliability Engineer

Vaga não está no LinkedIn

🕒 5 dias atrás

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of ArangoDB

ArangoDB

51 - 200 funcionários

Fundada em 2015

🏥 Saúde

📦 Logística

💼 Consultoria

💰 $27.800.000 Series B em 2021-10

Healthcare • Logistics • Consulting

ArangoDB é uma plataforma moderna de banco de dados de grafos que oferece uma solução abrangente para aplicações de Graph ML e GenAI. Conhecida por sua flexibilidade e escalabilidade, a ArangoDB integra, em uma única plataforma, sistemas de dados de grafos, documentos, busca full-text, chave-valor e geoespaciais. Isso permite que os usuários abordem diversos casos de uso, como detecção de fraude, cibersegurança e gestão de ativos de rede, com facilidade. A plataforma suporta uma ampla variedade de ambientes de implantação, incluindo cloud e Kubernetes, e oferece recursos avançados como análise de grafos, machine learning e ferramentas de visualização. Com sua robusta linguagem de consultas AQL e foco em inovação, a ArangoDB se destaca como líder em tecnologia de bancos de dados de grafos.

Descrição

• Design, implement, and maintain cloud infrastructure on AWS and Google Cloud platforms • Ensure the scalability, performance, and reliability of Kubernetes-based distributed database systems • Collaborate with developers to write production-grade Golang code for infrastructure automation and system operations • Optimize and automate CI/CD pipelines, deployment processes, and monitoring systems • Develop disaster recovery, high availability, and fault-tolerance strategies • Identify bottlenecks, troubleshoot, and resolve issues across networking, operating systems, and cloud infrastructure • Implement monitoring, logging, and alerting systems • Participate in on-call rotations and respond to production incidents • Collaborate with cross-functional teams to improve reliability and scalability • Collaborate with Customer Success to resolve customer issues

🎯 Requisitos

• Proven experience as an SRE or DevOps Engineer in a cloud-native environment • At least 3 years with Kubernetes in a production environment • Minimum 3 years of experience deploying and managing production-level cloud resources • Proficiency with Kubernetes for large-scale distributed systems • Experience with AWS and Google Cloud (GCP) • Understanding of networking, security practices, and troubleshooting • Understanding of Linux internals, including processes and environment variables • Familiarity with Docker and containerization technologies • Knowledge of CI/CD practices and tools such as Jenkins and CircleCI • Familiarity with Prometheus, Grafana, ELK stack, and observability tools • Knowledge of Git and version control systems • Familiarity with Golang or Python, or willingness and capability to learn and apply Golang • Ability to participate in on-call rotations • Strong troubleshooting, problem-solving, communication, and collaboration skills • Ability to self-organize and work independently as part of a remote team • Nice-to-have: distributed database or large-scale data storage experience • Nice-to-have: cloud security best practices • Nice-to-have: Python or Bash scripting • Nice-to-have: Terraform and Infrastructure-as-Code • Nice-to-have: GitOps experience • Nice-to-have: strong Golang programming experience

Candidatar-se

Vagas Similares

🕒 5 dias atrás

CampMinder

51 - 200

💼 Consultoria

🏥 Saúde

🏨 Hospitalidade

Senior DevSecOps Engineer securing Campminder’s software for summer camps. Hardening cloud infrastructure, embedding security in CI/CD, and leading compliance and threat-remediation work.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $180.000 - $200.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 5 dias atrás

MeridianLink

501 - 1000

💳 Fintech

🏦 Bancário

☁️ SaaS

Senior SRE owning reliability, observability, and scalability for MeridianLink’s financial SaaS applications. Designing resilient AWS/Azure infrastructure, automation, incident response, and security practices.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $104.148 - $177.600 / ano

💰 $485.000.000 Post-IPO Debt em 2021-11

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 5 dias atrás

eFinancial

201 - 500

🏥 Saúde

💼 Consultoria

🛡️ Seguros

DevOps Team Lead building AWS infrastructure, CI/CD pipelines, and shared engineering platforms for a life insurance provider. Coaching engineers and improving deployment reliability and automation.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 5 dias atrás

NEC Software Solutions

5001 - 10000

🏥 Saúde

💼 Consultoria

📦 Logística

Senior DevOps Engineer managing AWS cloud infrastructure, Kubernetes, Terraform, and CI/CD for NEC SWS public-sector systems. Hybrid role requiring 50% office attendance and SC eligibility.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 5 dias atrás

Blitzy

51 - 200

🤖 Inteligência Artificial

☁️ SaaS

🤝 B2B

Site Reliability Engineer operating Blitzy's AI software development platform in secure U.S. public-sector cloud environments. Managing Kubernetes, observability, reliability, and customer deployment operations.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $140.000 - $170.000 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório