Membro da Equipe Técnica | Observabilidade e Confiabilidade

Vaga não está no LinkedIn

🔥 8 minutos atrás

🇧🇷 Brasil – Remoto

⏰ Tempo Integral

🔴 Especialista

👻 Score fantasma 12%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of avra

avra

1 - 10 funcionários

💼 Consultoria

💸 Finanças

🤝 B2B

Consulting • Finance • B2B

Criamos a avra com um objetivo claro: capacitar fundadores de startups em estágio de crescimento com o alicerce adequado para escalar suas empresas após a rodada Series A.

Descrição

• Evoluir a stack de observabilidade para logs, métricas, traces e alertas • Garantir que cada dataplane em cloud e on-premises reporte ao control plane sua release ativa, integridade, heartbeat, logs, métricas e uso • Levar telemetria aos clusters dos clientes por meio de conexões de agentes somente de saída • Detectar divergências entre o estado desejado e o estado real em cada ambiente • Monitorar a integridade dos agentes de deployment e de runtime • Fornecer visibilidade sobre workloads efêmeros, como clusters Ray que executam inferência em lote • Definir SLOs, liderar a resposta a incidentes e os postmortems, e reduzir o MTTR, incluindo correções coordenadas com clientes • Reduzir o custo de telemetria eliminando dados redundantes e aprimorando os sinais • Alcançar 99,9% de disponibilidade do serving, reduzir incidentes e o MTTR, minimizar divergências de estado e garantir que todos os agentes estejam ativos e reportando

🎯 Requisitos

• Experiência profunda com OpenTelemetry e backends de observabilidade • Experiência prática com SLOs, error budgets, alertas acionáveis e gerenciamento de incidentes • Sólida experiência com Kubernetes e infraestrutura como código (Terraform / Helm) • Experiência na operação de software em ambientes que não estão totalmente sob seu controle • Código e revisões com qualidade de produção, além de disposição para operar o que você desenvolve • Será um diferencial: experiência no envio de software para Kubernetes hospedado pelos clientes (por exemplo, Helm e conectividade somente de saída) • Será um diferencial: experiência com GCP ou GKE, AWS ou EKS • Será um diferencial: experiência com workloads de ML multinode e multicluster em produção • Será um diferencial: experiência em serviços financeiros ou ambientes regulamentados

Candidatar-se