
51 - 200 funcionários
Fundada em 2017
🤝 B2B
🏢 Corporativo
🎯 Recrutamento
B2B • Enterprise • Recruitment
A GrooveTech é uma empresa brasileira de serviços de TI que oferece aumento gerenciado de pessoal e squads, garantia de qualidade de software, monitoramento NOC 24x7 e consultoria estratégica em TI, incluindo due diligence digital para M&A. Fornecem equipes gerenciadas (Executivos de TI, PM/PO, líderes técnicos e parceiros de negócios), relatórios diários e foco no ROI através da redução de turnover e melhoria de desempenho de projetos por meio de automação de testes, monitoramento (no local e na nuvem) e modelos de entrega personalizados.
🔥 0 minutos atrás
🇧🇷 Brasil – Remoto
⏳ Contrato/Temporário
🟠 Sênior
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇧🇷🇵🇹 Português obrigatório
Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

51 - 200 funcionários
Fundada em 2017
🤝 B2B
🏢 Corporativo
🎯 Recrutamento
B2B • Enterprise • Recruitment
A GrooveTech é uma empresa brasileira de serviços de TI que oferece aumento gerenciado de pessoal e squads, garantia de qualidade de software, monitoramento NOC 24x7 e consultoria estratégica em TI, incluindo due diligence digital para M&A. Fornecem equipes gerenciadas (Executivos de TI, PM/PO, líderes técnicos e parceiros de negócios), relatórios diários e foco no ROI através da redução de turnover e melhoria de desempenho de projetos por meio de automação de testes, monitoramento (no local e na nuvem) e modelos de entrega personalizados.
• Liderar tecnicamente a evolução da infraestrutura em GCP, principalmente GKE, Compute Engine, Cloud SQL, Cloud Storage, VPC, Load Balancing, IAM, Cloud DNS, Secret Manager, Pub/Sub e BigQuery • Projetar arquiteturas com foco em alta disponibilidade, escalabilidade, resiliência, segurança, performance e custo • Atuar com práticas de SRE, definindo e acompanhando SLIs, SLOs e Error Budgets • Monitorar indicadores de confiabilidade como disponibilidade, latência, throughput, taxa de erro, saturação, capacidade, MTTR e MTBF • Administrar e realizar troubleshooting avançado em Kubernetes/GKE em produção • Definir estratégias de autoscaling, capacity planning, resource management e workload isolation • Evoluir a estratégia de observabilidade utilizando New Relic, OpenTelemetry, Prometheus, Grafana e ferramentas nativas de cloud • Criar dashboards, alertas e métricas técnicas e de negócio, garantindo observabilidade acionável • Atuar como Incident Commander em incidentes críticos e conduzir postmortems blameless • Administrar e evoluir infraestrutura como código utilizando Terraform • Desenvolver e manter módulos reutilizáveis, padrões de configuração, state management e pipelines de Terraform • Administrar pipelines de CI/CD com GitHub Actions e processos de deployment utilizando ArgoCD/GitOps • Implementar estratégias de rolling, blue/green e canary deployments • Desenvolver automações utilizando Go, Python e Bash • Criar soluções de Platform Engineering, self-service, templates, automações e golden paths • Atuar com networking cloud, segurança, governança, IAM/RBAC, secrets, certificados e criptografia • Contribuir para iniciativas de FinOps, otimização de recursos, rightsizing e redução de desperdícios • Projetar e validar estratégias de Disaster Recovery, backup, restore, failover, RPO e RTO • Atuar com performance e capacity planning, antecipando gargalos e necessidades de crescimento
• 5+ anos de experiência atuando com infraestrutura crítica em produção em cloud pública • Experiência sólida com Google Cloud Platform (GCP) • Experiência prática com Kubernetes em produção, preferencialmente GKE • Conhecimento avançado de Terraform, incluindo módulos, state, versionamento e organização de ambientes • Experiência prática com SLIs, SLOs e Error Budgets • Conhecimento avançado de troubleshooting em Linux, redes, DNS, HTTP, TLS, Load Balancers e Kubernetes • Experiência com automação utilizando Go, Python e/ou Bash • Experiência com GitHub Actions, ArgoCD e GitOps • Experiência na condução de incidentes críticos, postmortems e análise de causa raiz • Capacidade de atuar em decisões arquiteturais e comunicar trade-offs técnicos, operacionais e financeiros • GCP é essencial • AWS e/ou Azure são desejáveis • Diferenciais: experiência em mais de um provedor de cloud; ambientes multi-cloud ou hybrid cloud; arquiteturas multi-região e Disaster Recovery; AWS EKS, RDS/Aurora e multi-account; Azure AKS e Landing Zones; Service Mesh (Istio, Linkerd ou Anthos Service Mesh); API Gateway e gerenciamento de APIs; Chaos Engineering; FinOps; Platform Engineering
• Contratação PJ • Modelo de trabalho remoto • Wellhub • Seguro de Vida
Candidatar-se🕒 Agosto 5
Engenheiro DevOps sênior construindo pipelines CI/CD, orquestrando Kubernetes e automatizando infraestrutura cloud para uma instituição de pagamentos. Garantindo alta disponibilidade, segurança, performance e escalabilidade em ambientes de produção.
🇧🇷 Brasil – Remoto
⏳ Contrato/Temporário
🟡 Pleno
🟠 Sênior
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇧🇷🇵🇹 Português obrigatório
🕒 Julho 28
DevOps Manager leading Azure cloud and Kubernetes environments for a power management platform. Managing CI/CD, incident lifecycle, and a technical team within a remote LATAM context.
🇧🇷 Brasil – Remoto
⏳ Contrato/Temporário
🟡 Pleno
🟠 Sênior
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 Julho 21
Engenheiro(a) DevSecOps construindo, mantendo e escalando infraestrutura em nuvem segura e pipelines de CI/CD com mentalidade de segurança em primeiro lugar. Colaborará com uma equipe pequena para garantir a segurança da plataforma e a conformidade.
🇧🇷 Brasil – Remoto
⏳ Contrato/Temporário
🟡 Pleno
🟠 Sênior
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 Julho 19
Engenheiro de nuvem projetando e mantendo infraestrutura AWS escalável para aplicações críticas na Metal Toad. Buscamos profissionais talentosos com sólido conhecimento em AWS e tecnologias de nuvem para atuação remota.
🇧🇷 Brasil – Remoto
⏳ Contrato/Temporário
🟡 Pleno
🟠 Sênior
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇺🇸🇬🇧 Inglês obrigatório
🗣️🇧🇷🇵🇹 Português obrigatório
🕒 Julho 16
Vaga de SRE para gerenciamento de incidentes críticos e observabilidade de soluções SaaS na América Latina. Responsabilidades incluem monitoramento, resposta a incidentes e aprimoramento da observabilidade da plataforma.
🇧🇷 Brasil – Remoto
⏳ Contrato/Temporário
🟡 Pleno
🟠 Sênior
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇧🇷🇵🇹 Português obrigatório