Engenheiro(a) de Confiabilidade de Sites

Vaga não está no LinkedIn

🕒 Maio 28

🌏 Qualquer lugar do mundo

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Chess.com

Chess.com

501 - 1000 funcionários

Fundada em 2007

🎮 Jogos

📚 Educação

📱 Mídia

💰 Private Equity Round em 2022-01

Gaming • Education • Media

Chess. com é a principal plataforma online para jogar e aprender xadrez, oferecendo uma ampla gama de recursos, como partidas ao vivo com outros jogadores, bots de treinamento personalizáveis, puzzles de xadrez e aulas abrangentes. A plataforma é amplamente reconhecida por aprimorar o reconhecimento de padrões e as habilidades gerais de xadrez dos jogadores. A Chess. com também oferece cobertura dos principais eventos de xadrez, como o Campeonato Mundial da FIDE. Com foco em criar uma comunidade acolhedora e engajante para jogadores de todos os níveis, a Chess. com é uma referência para quem deseja melhorar seu jogo ou desfrutar de partidas competitivas.

Descrição

• Projetar e implementar infraestrutura multi-regional resiliente, capaz de suportar milhões de sessões e transações concorrentes diariamente em data centers globais • Liderar a estratégia de migração para nuvem híbrida, integrando recursos de datacenter bare-metal com serviços em nuvem para otimizar desempenho e custo • Ser responsável pela escala de plantão (on-call) e pelos procedimentos de resposta a incidentes, garantindo resolução rápida de problemas críticos e manutenção de SLAs de alta disponibilidade • Arquitetar sistemas de monitoramento e alerta usando ferramentas padrão do setor para identificar e resolver proativamente gargalos de desempenho antes que impactem os usuários • Colaborar com equipes de desenvolvimento para implementar práticas de infraestrutura como código e estabelecer pipelines de deploy que suportem integração e entrega contínuas (CI/CD) • Otimizar o desempenho do sistema por meio de planejamento de capacidade, testes de carga e alocação de recursos em ambientes distribuídos • Estabelecer e manter protocolos de segurança e procedimentos de avaliação de risco para componentes de infraestrutura e proteção de dados • Trabalhar em parceria com equipes de engenharia para projetar soluções escaláveis para aplicações de alto tráfego e requisitos de processamento em tempo real • Conduzir iniciativas de automação para reduzir o esforço operacional manual e melhorar a confiabilidade do sistema por meio de scripting e gerenciamento de configuração • Mentorar membros da equipe em boas práticas de SRE e contribuir para o desenvolvimento de padrões e documentação de infraestrutura

🎯 Requisitos

• Graduação em Ciência da Computação, Engenharia ou área técnica relacionada, ou experiência prática equivalente • Mais de 5 anos de experiência em funções de site reliability engineering, DevOps ou engenharia de infraestrutura • Sólida proficiência em sistemas operacionais UNIX/Linux e administração em linha de comando • Experiência com plataformas em nuvem (GCP, AWS ou Azure) e ferramentas de infraestrutura como código (Terraform, CloudFormation ou similares) • Experiência prática com sistemas de gerenciamento de configuração (Ansible, Chef, Puppet ou similares) • Bom entendimento dos fundamentos de redes, protocolos (TCP/IP, HTTP/HTTPS, DNS) e solução de problemas de rede • Experiência com tecnologias de containerização e orquestração (Docker, Kubernetes ou similares) • Proficiência com ferramentas de monitoramento e observabilidade (Datadog, Prometheus, Grafana, ELK stack ou similares) • Experiência com bancos de dados relacionais e NoSQL, incluindo otimização de desempenho e estratégias de escalonamento • Fortes habilidades de colaboração e comunicação para atuar eficazmente em um ambiente de equipe distribuída • Demonstração de senso de propriedade e responsabilidade pela confiabilidade e desempenho dos sistemas • Diferenciais: • Experiência em gerenciamento de infraestrutura bare-metal e operações de datacenter • Conhecimento avançado de Content Delivery Networks (CDNs) e edge computing • Experiência com automação de servidor e linguagens de scripting (Python, Go, Bash ou similares) • Experiência com arquiteturas de alta disponibilidade e planejamento de recuperação de desastres • Familiaridade com frameworks de segurança e requisitos de conformidade • Experiência com infraestrutura de servidores de jogos ou hospedagem de aplicações em tempo real • Conhecimento de administração de banco de dados e otimização para aplicações de alta concorrência • Entendimento de pipelines de CI/CD e automação de deploy • Experiência com planejamento de capacidade e ferramentas de teste de desempenho • Experiência prévia em ambiente de trabalho totalmente remoto e distribuído • Mentalidade de aprendizado contínuo e interesse em tecnologias emergentes de infraestrutura

🏖️ Benefícios

• 100% remoto (trabalhe de qualquer lugar!)

Candidatar-se

Vagas Similares

🕒 Maio 13

Shuru

51 - 200

🤖 Inteligência Artificial

🤝 B2B

🏢 Corporativo

Engenheiro(a) Sênior de DevOps ajudando a escalar a plataforma em nuvem de pré-produção para produção em uma fintech. Colaboração com equipes para aprimorar infraestrutura, processos de deploy e monitoramento.

🌏 Qualquer lugar do mundo

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Abril 16

Supabase

51 - 200

☁️ SaaS

🔌 API

🤖 Inteligência Artificial

Engenheiro responsável pela infraestrutura de deployment e operacional do Multigres, uma plataforma de Postgres distribuído. Construção e manutenção do Multigres Operator no Kubernetes, colaborando com várias equipes.

🌏 Qualquer lugar do mundo

💰 $80.000.000 Series B em 2022-05

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Abril 1

Canonical

501 - 1000

Engenheiro(a) de Confiabilidade de Site aplicando práticas de DevOps para a Canonical, líder em software open source. Foco em automação e gestão de infraestrutura em diversos ambientes de nuvem.

🌏 Qualquer lugar do mundo

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Abril 1

Canonical

501 - 1000

Engenheiro Sênior de Site Reliability / GitOps desenvolvendo soluções de automação para os serviços de TI da Canonical. Colaboração global para aprimorar eficiência operacional e gestão de infraestrutura.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Abril 1

Canonical

501 - 1000

Engenheiro Sênior de Confiabilidade de Site com infraestrutura como código em Python para operações em nuvem na Canonical. Viabilizando DevSecOps para aplicações em OpenStack e Kubernetes em um ambiente global remoto.

🗣️🇺🇸🇬🇧 Inglês obrigatório