Cloud Engineer / Site Reliability Engineer (SRE) Sênior

🔥 0 minutos atrás

🗣️🇧🇷🇵🇹 Português obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of GrooveTech

GrooveTech

51 - 200 funcionários

Fundada em 2017

🤝 B2B

🏢 Corporativo

🎯 Recrutamento

B2B • Enterprise • Recruitment

A GrooveTech é uma empresa brasileira de serviços de TI que oferece aumento gerenciado de pessoal e squads, garantia de qualidade de software, monitoramento NOC 24x7 e consultoria estratégica em TI, incluindo due diligence digital para M&A. Fornecem equipes gerenciadas (Executivos de TI, PM/PO, líderes técnicos e parceiros de negócios), relatórios diários e foco no ROI através da redução de turnover e melhoria de desempenho de projetos por meio de automação de testes, monitoramento (no local e na nuvem) e modelos de entrega personalizados.

Descrição

• Liderar tecnicamente a evolução da infraestrutura em GCP, principalmente GKE, Compute Engine, Cloud SQL, Cloud Storage, VPC, Load Balancing, IAM, Cloud DNS, Secret Manager, Pub/Sub e BigQuery • Projetar arquiteturas com foco em alta disponibilidade, escalabilidade, resiliência, segurança, performance e custo • Atuar com práticas de SRE, definindo e acompanhando SLIs, SLOs e Error Budgets • Monitorar indicadores de confiabilidade como disponibilidade, latência, throughput, taxa de erro, saturação, capacidade, MTTR e MTBF • Administrar e realizar troubleshooting avançado em Kubernetes/GKE em produção • Definir estratégias de autoscaling, capacity planning, resource management e workload isolation • Evoluir a estratégia de observabilidade utilizando New Relic, OpenTelemetry, Prometheus, Grafana e ferramentas nativas de cloud • Criar dashboards, alertas e métricas técnicas e de negócio, garantindo observabilidade acionável • Atuar como Incident Commander em incidentes críticos e conduzir postmortems blameless • Administrar e evoluir infraestrutura como código utilizando Terraform • Desenvolver e manter módulos reutilizáveis, padrões de configuração, state management e pipelines de Terraform • Administrar pipelines de CI/CD com GitHub Actions e processos de deployment utilizando ArgoCD/GitOps • Implementar estratégias de rolling, blue/green e canary deployments • Desenvolver automações utilizando Go, Python e Bash • Criar soluções de Platform Engineering, self-service, templates, automações e golden paths • Atuar com networking cloud, segurança, governança, IAM/RBAC, secrets, certificados e criptografia • Contribuir para iniciativas de FinOps, otimização de recursos, rightsizing e redução de desperdícios • Projetar e validar estratégias de Disaster Recovery, backup, restore, failover, RPO e RTO • Atuar com performance e capacity planning, antecipando gargalos e necessidades de crescimento

🎯 Requisitos

• 5+ anos de experiência atuando com infraestrutura crítica em produção em cloud pública • Experiência sólida com Google Cloud Platform (GCP) • Experiência prática com Kubernetes em produção, preferencialmente GKE • Conhecimento avançado de Terraform, incluindo módulos, state, versionamento e organização de ambientes • Experiência prática com SLIs, SLOs e Error Budgets • Conhecimento avançado de troubleshooting em Linux, redes, DNS, HTTP, TLS, Load Balancers e Kubernetes • Experiência com automação utilizando Go, Python e/ou Bash • Experiência com GitHub Actions, ArgoCD e GitOps • Experiência na condução de incidentes críticos, postmortems e análise de causa raiz • Capacidade de atuar em decisões arquiteturais e comunicar trade-offs técnicos, operacionais e financeiros • GCP é essencial • AWS e/ou Azure são desejáveis • Diferenciais: experiência em mais de um provedor de cloud; ambientes multi-cloud ou hybrid cloud; arquiteturas multi-região e Disaster Recovery; AWS EKS, RDS/Aurora e multi-account; Azure AKS e Landing Zones; Service Mesh (Istio, Linkerd ou Anthos Service Mesh); API Gateway e gerenciamento de APIs; Chaos Engineering; FinOps; Platform Engineering

🏖️ Benefícios

• Contratação PJ • Modelo de trabalho remoto • Wellhub • Seguro de Vida

Candidatar-se

Vagas Similares

🕒 Agosto 5

Grupo Adriano Cobuccio

1001 - 5000

📦 Logística

💼 Consultoria

🏭 Manufatura

Engenheiro DevOps sênior construindo pipelines CI/CD, orquestrando Kubernetes e automatizando infraestrutura cloud para uma instituição de pagamentos. Garantindo alta disponibilidade, segurança, performance e escalabilidade em ambientes de produção.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Julho 28

In All Media

1001 - 5000

💼 Consultoria

📣 Marketing

☁️ SaaS

DevOps Manager leading Azure cloud and Kubernetes environments for a power management platform. Managing CI/CD, incident lifecycle, and a technical team within a remote LATAM context.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 21

Uberall

201 - 500

🍽️ Alimentos e Bebidas

🏨 Hospitalidade

🚘 Automotivo

Engenheiro(a) DevSecOps construindo, mantendo e escalando infraestrutura em nuvem segura e pipelines de CI/CD com mentalidade de segurança em primeiro lugar. Colaborará com uma equipe pequena para garantir a segurança da plataforma e a conformidade.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 19

Metal Toad

11 - 50

💼 Consultoria

📣 Marketing

📦 Logística

Engenheiro de nuvem projetando e mantendo infraestrutura AWS escalável para aplicações críticas na Metal Toad. Buscamos profissionais talentosos com sólido conhecimento em AWS e tecnologias de nuvem para atuação remota.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Julho 16

CIAL Dun & Bradstreet

201 - 500

💼 Consultoria

📦 Logística

📣 Marketing

Vaga de SRE para gerenciamento de incidentes críticos e observabilidade de soluções SaaS na América Latina. Responsabilidades incluem monitoramento, resposta a incidentes e aprimoramento da observabilidade da plataforma.

🗣️🇧🇷🇵🇹 Português obrigatório