SRE Engineer - REMOTO

🔥 6 minutos atrás

🇧🇷 Brasil – Remoto

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

👻 Score fantasma 12%

infoinfo

🗣️🇧🇷🇵🇹 Português obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Verity Group

Verity Group

51 - 200 funcionários

Fundada em 2010

💼 Consultoria

🤖 Inteligência Artificial

🔒 Cibersegurança

Consulting • Artificial Intelligence • Cybersecurity

A Verity Group é uma consultoria de transformação digital e inovação focada em gerar resultados reais por meio da tecnologia. Com expertise em áreas como migração para IA, hiperautomação, cibersegurança e engenharia digital, a Verity Group faz parceria com empresas ambiciosas para desenvolver soluções estratégicas de negócios. A empresa se orgulha de priorizar a profundidade em vez do volume, garantindo serviços sob medida que impulsionam eficiência e crescimento em toda a jornada tecnológica, da estratégia à execução.

Descrição

• Definir e acompanhar SLIs, SLOs, SLAs, MTTR e MTTD • Implementar observabilidade, monitoramento, alertas e APM • Monitorar latência, tráfego, erros, saturação, disponibilidade e performance • Atuar na prevenção, identificação e resolução de incidentes • Conduzir análises de causa raiz e definir ações para evitar recorrências • Identificar riscos, gargalos e pontos únicos de falha • Apoiar o desenho de soluções resilientes, escaláveis e altamente disponíveis • Automatizar atividades operacionais e reduzir tarefas manuais • Operar e evoluir ambientes Kubernetes e Docker • Apoiar estratégias de capacidade, continuidade e recuperação de desastres • Participar de deploys e apoiar a estabilização das aplicações • Trabalhar com os times para melhorar a confiabilidade desde a concepção das soluções • Criar e manter dashboards, alertas, procedimentos e documentação operacional • Promover uma cultura de confiabilidade, observabilidade e melhoria contínua

🎯 Requisitos

• Experiência como Site Reliability Engineer, SRE ou função equivalente • Experiência prática com ambientes Cloud, utilizando GCP, AWS e/ou Azure • Conhecimento em Kubernetes e Docker • Experiência com observabilidade, monitoramento, alertas e APM • Conhecimento em métricas e práticas de SRE, como SLI, SLO, SLA, MTTR e MTTD • Experiência em gestão, investigação e resolução de incidentes • Conhecimento em troubleshooting de aplicações e infraestrutura • Experiência com administração de ambientes Linux • Conhecimento em redes, segurança, performance e alta disponibilidade • Experiência com automação e Infrastructure as Code • Vivência com pipelines de CI/CD • Boa comunicação e capacidade de atuar com times multidisciplinares • Perfil analítico, proativo, colaborativo e orientado à prevenção de problemas • Experiência com GKE, EKS ou AKS • Conhecimento em Dynatrace, Datadog, Grafana, Prometheus ou ferramentas similares • Experiência com ELK Stack, Elasticsearch e Kibana • Conhecimento em Terraform e Ansible • Experiência com ambientes críticos e sistemas distribuídos • Vivência em instituições financeiras ou ambientes regulados • Experiência com gestão de capacidade e otimização de custos Cloud • Conhecimento em disaster recovery e continuidade de negócio • Experiência na definição e gestão de error budgets • Certificações em Cloud, Kubernetes ou SRE • Disponibilidade para contratação CLT, conforme formulário de candidatura

🏖️ Benefícios

• Vale refeição • Vale alimentação • Auxílio home office • Assistência médica • Assistência odontológica • Seguro de vida • DayOff no aniversário • Total Pass / Wellhub • App Boon Saúde • Parcerias de descontos • Convênios em estabelecimentos e instituições de ensino • Kit de Boas-vindas • Onboarding • Verity Learning • Intervalo Verity • #VerityComVocê • Great Place to Work certification

Candidatar-se

Vagas Similares

🔥 41 minutos atrás

CI&T

5001 - 10000

💼 Consultoria

🏥 Saúde

📣 Marketing

Engenheiro(a) de Confiabilidade de Sites responsável pela operação de plataformas de monitoramento e pela melhoria da confiabilidade em cloud das soluções de transformação com IA da CI&T. Automação de observabilidade, resposta a incidentes e remediação de riscos de cibersegurança.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🔥 6 horas atrás

Franq

51 - 200

🛡️ Seguros

💼 Consultoria

💳 Fintech

DevOps/SRE responsável pela administração de Kubernetes, AWS/GCP e automação de infraestrutura na Franq. Fortalecer a observabilidade, o CI/CD, a disponibilidade e a confiabilidade de sistemas financeiros.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 4 dias atrás

SoftDesign

51 - 200

🤖 Inteligência Artificial

☁️ SaaS

Engenheiro(a) de DevOps responsável por construir plataformas Azure, infraestrutura Kubernetes e automação de CI/CD na SoftDesign. Aprimorando a observabilidade, o DevSecOps e a experiência dos desenvolvedores.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 4 dias atrás

GFT Technologies

10.000+ funcionários

💼 Consultoria

🛡️ Seguros

🔒 Cibersegurança

Especialista DevOps responsável por construir e arquitetar plataformas AKS multiambiente na GFT Technologies. Automatizando a infraestrutura Azure, a alta disponibilidade e a migração de aplicações para contêineres.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 4 dias atrás

Aiphoria

51 - 200

💼 Consultoria

📦 Logística

📣 Marketing

Engenheiro(a) de DevOps Sênior responsável por operar Kubernetes, ambientes de nuvem e infraestrutura de inferência em GPU para uma empresa de produtos de IA. Construção de plataformas de produção remotas, seguras, observáveis e escaláveis.

🗣️🇺🇸🇬🇧 Inglês obrigatório