Engenheiro(a) SRE Sênior – Observabilidade & Confiabilidade | Groovetech

Vaga não está no LinkedIn

🔥 13 minutos atrás

🇧🇷 Brasil – Remoto

⏳ Contrato/Temporário

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

👻 Score fantasma 13%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

🗣️🇧🇷🇵🇹 Português obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of GrooveTech

GrooveTech

51 - 200 funcionários

Fundada em 2017

🤝 B2B

🏢 Corporativo

🎯 Recrutamento

B2B • Enterprise • Recruitment

A GrooveTech é uma empresa brasileira de serviços de TI que oferece aumento gerenciado de pessoal e squads, garantia de qualidade de software, monitoramento NOC 24x7 e consultoria estratégica em TI, incluindo due diligence digital para M&A. Fornecem equipes gerenciadas (Executivos de TI, PM/PO, líderes técnicos e parceiros de negócios), relatórios diários e foco no ROI através da redução de turnover e melhoria de desempenho de projetos por meio de automação de testes, monitoramento (no local e na nuvem) e modelos de entrega personalizados.

Descrição

• Liderar a administração e evolução do Datadog como plataforma central de observabilidade (APM, traces, pipelines de logs, métricas, RUM, Synthetics, SLOs, monitores e Cloud SIEM) • Garantir cobertura total de observabilidade para ambientes produtivos na AWS (ECS, Lambda, API Gateway, DynamoDB, EventBridge/SQS, CloudFront e WAF) • Definir e acompanhar SLIs e SLOs para jornadas críticas, monitorando o consumo de error budget • Desenhar alertas focados em sinal, eliminando falsos positivos, re-notificações e monitores ineficientes • Integrar e auditar logs de segurança (CloudTrail, GuardDuty, Inspector, Macie, VPC Flow Logs) • Conduzir a resposta a incidentes críticos, incluindo triagem, correlação de eventos, comunicação transparente e liderança de RCAs e postmortems • Manter a governança técnica por meio da elaboração de runbooks, playbooks e apoio a processos de Gestão de Mudanças no Jira Service Management • Apoiar a conformidade PCI DSS, produzindo evidências de monitoramento, logging e FIM, além de suporte a auditorias e testes de penetração • Gerenciar FinOps em Observabilidade, otimizando custos com retenção, indexação de logs e cardinalidade de métricas no Datadog • Atuar como referência técnica e responsável pela observabilidade e confiabilidade da plataforma

🎯 Requisitos

• Trajetória sólida e prática (+8 anos) em SRE, Observabilidade ou Sustentação de Ambientes Críticos • Domínio profundo e avançado da plataforma Datadog (APM, Traces, Logs, Synthetics, SLOs e Dashboards) • Forte conhecimento em arquitetura AWS voltado a troubleshooting operacional (CloudWatch, CloudTrail, ECS, Lambda, filas e eventos) • Prática em gestão de incidentes, problemas e mudanças (ITIL ou equivalente) • Histórico em elaboração de documentação técnica estruturada (runbooks, playbooks e postmortems) • Capacidade de executar, corrigir e entregar com agilidade, sem se limitar ao nível teórico/arquitetural • Capacidade de gerenciar a disciplina de observabilidade e priorizar backlogs com independência, sem necessidade de microgerenciamento • Excelente capacidade de adaptação a rotinas dinâmicas, com receptividade a feedbacks e foco na melhoria contínua • Excelente relacionamento interpessoal para trabalhar de forma alinhada e transparente com os times de engenharia, QA e produto • Inglês Avançado a Fluente • Experiência em ambientes de meios de pagamento, fintechs ou regulados por PCI DSS • Conhecimentos em Cloud SIEM e ferramentas de segurança AWS (GuardDuty, Inspector, Macie) • Práticas de Observabilidade como Código (Terraform / API Datadog) • Leitura e análise de código em Go e/ou TypeScript/Node.js para apoio em diagnósticos

🏖️ Benefícios

• Seguro de Vida • Acesso ao ecossistema Wellhub (antigo Gympass) • Acompanhamento pelo Back Office técnico e de gestão para garantir onboarding acelerado e suporte na jornada

Candidatar-se

Vagas Similares

🔥 14 minutos atrás

Finaya

11 - 50

💳 Fintech

☁️ SaaS

🔌 API

Engenheiro(a) SRE/DevOps garantindo a confiabilidade dos serviços financeiros críticos da Finaya. Gerenciando AWS, Kubernetes, observabilidade, incidentes, Terraform e pipelines de CI/CD.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Setembro 30

DOMVS iT

51 - 200

💼 Consultoria

🏥 Saúde

🏢 Corporativo

DevOps Sênior responsável pela construção de pipelines de CI/CD e da infraestrutura AWS/Terraform de um assistente financeiro baseado em IA da DOMVS iT. Trabalho 100% remoto, com integração via WhatsApp.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Setembro 17

Metal Toad

11 - 50

💼 Consultoria

📣 Marketing

📦 Logística

Engenheiro(a) de DevOps responsável por projetar e manter uma infraestrutura AWS escalável para a Metal Toad, parceira estratégica em IA. Atuará no suporte a aplicações de alta disponibilidade, serviços gerenciados, automação, segurança e recuperação de desastres.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 2

Sabiá Administração

51 - 200

🎲 Jogos de Azar

📣 Marketing

SRE responsável por garantir a disponibilidade, a resiliência e a resposta a incidentes na plataforma iGaming da Cometa Gaming. Automação de infraestrutura, CI/CD, Kubernetes e observabilidade.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Agosto 19

Inflect

11 - 50

☁️ SaaS

Consultor Sênior de DevOps projetando plataformas AWS EKS confiáveis para o marketplace de infraestrutura digital da Inflect. Entrega de soluções em Terraform, SRE, OpenTelemetry e CI/CD.

🗣️🇺🇸🇬🇧 Inglês obrigatório