Sênior Site Reliability Engineer

🕒 Junho 27

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Visa

Visa

10.000+ funcionários

💳 Fintech

💸 Finanças

🏦 Bancário

💰 Post IPO equity em 2016-10

Fintech • Finance • Banking

A Visa é uma empresa global de tecnologia em pagamentos que conecta consumidores, comerciantes, instituições financeiras e governos para viabilizar pagamentos e comércio eletrônico. Ela opera uma rede mundial de cartões para pagamentos com crédito, débito e pré-pagos, fornecendo serviços de processamento de pagamentos, segurança e mitigação de fraudes, análise de dados e produtos de valor agregado para consumidores e empresas. A Visa investe em soluções de pagamento de próxima geração (incluindo comércio impulsionado por IA), apoia iniciativas de inclusão financeira através da Visa Foundation e oferece benefícios de cartões para consumidores e serviços para comerciantes.

Descrição

• Ser responsável pelo ciclo de vida completo (projeto, provisionamento, upgrades, manutenção e descomissionamento) de componentes centrais da plataforma, incluindo: primitivas de infraestrutura em nuvem, clusters Kubernetes e serviços de cluster, rede, ingress e descoberta de serviços, Service Mesh e componentes de data‑plane de suporte. • Projetar componentes da plataforma para serem resilientes por padrão, aplicando princípios de SRE como isolamento de falhas e degradação graciosa, planejamento de capacidade e controle de saturação, redução do trabalho operacional manual e modos de falha claros. • Liderar o design e a implementação da orquestração de bootstrap da infraestrutura, incluindo provisionamento automatizado de clusters e ambientes, inicialização e desmontagem determinísticas e repetíveis da plataforma, e orquestração consciente de dependências entre camadas de nuvem, rede e Kubernetes. • Promover práticas Infrastructure-as-Code e GitOps como prioridade para garantir: que os componentes da plataforma sejam reproduzíveis e auditáveis, que as mudanças sejam automatizadas, testáveis e reversíveis, e que a intervenção manual seja minimizada ou eliminada. • Identificar lacunas de automação e liderar iniciativas que reduzam esforço humano, tempo de onboarding e risco operacional. • Aplicar e promover práticas de excelência operacional SRE, incluindo propriedade clara e runbooks para componentes da plataforma, participação em rodízio de on‑call como ponto de escalonamento de confiabilidade da plataforma, resposta a incidentes, análises pós‑incidente e gerenciamento de problemas. • Melhorar operações de day‑2 padronizando estratégias de upgrade/rollback e reduzindo MTTD/MTTR. • Garantir que as operações da plataforma estejam alinhadas com requisitos de segurança, conformidade e controles internos. • Colaborar com equipes de engenharia em toda a organização para influenciar adoção da plataforma, padrões de confiabilidade e melhores práticas cloud‑native.

🎯 Requisitos

• Experiência comprovada em operar e administrar Kubernetes em escala em ambientes de produção. • Forte experiência com plataformas de orquestração de containers e fundamentos de arquitetura de cloud (rede, conceitos de IAM/segurança e padrões de confiabilidade). • Experiência com Infrastructure as Code (preferência por Terraform) e fluxos de trabalho com automação em primeiro lugar. • Familiaridade com práticas GitOps e pipelines CI/CD. • Fortes habilidades de troubleshooting em sistemas distribuídos, incluindo análise de causa raiz e melhorias de confiabilidade. • Experiência com conceitos e práticas de observabilidade (monitoramento, logging, alertas, tracing). • Proficiência em inglês nível B2 ou superior (Intermediário Superior).

🏖️ Benefícios

• Plano de saúde • Contribuição correspondente ao 401(k) • Horário de trabalho flexível • Licença remunerada • Opções de trabalho remoto

Candidatar-se

Vagas Similares

🕒 Junho 27

Devexperts

501 - 1000

💳 Fintech

☁️ SaaS

💸 Finanças

Engenheiro de Confiabilidade de Site responsável por garantir a estabilidade das plataformas de negociação na Devexperts. Colabora com as equipes para implantar e manter serviços de forma eficaz, promovendo automação.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Junho 27

Gorillas Group

51 - 200

💼 Consultoria

📣 Marketing

📦 Logística

Vaga de SRE Sênior focada em aprimorar confiabilidade, observabilidade e processos operacionais na Goritek, empresa de tecnologia atuando em mercado regulado.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Junho 25

RHI Magnesita

10.000+ funcionários

💼 Consultoria

📦 Logística

🏭 Manufatura

Analista DevOps SR apoiando a transformação digital na RHI Magnesita. Atue no desenvolvimento de soluções técnicas e no direcionamento de equipes na infraestrutura em nuvem.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Junho 25

Airbnb

5001 - 10000

✈️ Turismo

📦 Logística

🛍️ Comércio Eletrônico

Engenheiro(a) de Software Sênior na Equipe de Engenharia de Confiabilidade do Airbnb. Focado(a) no desenvolvimento de ferramentas para confiabilidade de serviços e gerenciamento de incidentes.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Junho 24

Experian

10.000+ funcionários

💼 Consultoria

📣 Marketing

📦 Logística

Especialista de SRE gerenciando operações de cloud e automação. Colaborando em uma squad de SRE para aumentar a produtividade e resolver desafios técnicos.

🗣️🇧🇷🇵🇹 Português obrigatório

🗣️🇺🇸🇬🇧 Inglês obrigatório