Engenheiro(a) Sênior de DevOps / Plataforma

Vaga não está no LinkedIn

🔥 13 horas atrás

🌐 México, Brasil, +2 outros países – Remoto

infoinfo

⏰ Tempo Integral

🟠 Sênior

🏗️ Engenheiro de Plataforma

👻 Score fantasma 10%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Helpware

Helpware

1001 - 5000 funcionários

Fundada em 2015

📦 Logística

📣 Marketing

💼 Consultoria

💰 Seed Round em 2016-01

Logistics • Marketing • Consulting

A Helpware é uma empresa de terceirização de serviços digitalmente habilitada que se especializa em aprimorar experiências digitais do cliente para empresas de tecnologia em rápido crescimento e que estão revolucionando o mercado. Eles oferecem uma gama de serviços, incluindo atendimento ao cliente com IA, controle e verificação de conteúdo, suporte de back-office, rotulagem de dados, marketing digital, cibersegurança e desenvolvimento de software. A Helpware foca em proporcionar experiências superiores ao cliente e expandir marcas ao integrar serviços de tarefas humanas com soluções tecnológicas. Com locais ao redor do mundo, eles oferecem equipes escaláveis e culturalmente alinhadas em várias indústrias, como eCommerce, SaaS, saúde e finanças.

Descrição

• Contribuir para projetos de arquitetura em nuvem utilizando os pilares do AWS Well-Architected Framework: segurança, excelência operacional, eficiência de performance, confiabilidade e otimização de custos • Ser responsável pelo ambiente AWS, incluindo serviços ECS Fargate, workloads em Lambda e Batch, RDS PostgreSQL, ElastiCache Redis, S3, CloudWatch, redes/IAM e Bedrock • Gerenciar infraestrutura como código com provisionamento revisável e repetível para ambientes de desenvolvimento, teste, homologação e produção • Operar a stack de observabilidade e o Langfuse self-hosted, incluindo implantação, atualizações, backup/restauração e controle de acesso • Criar e manter pipelines de CI/CD e gates de conformidade da plataforma, incluindo testes de contrato para padrões de logging e um linter de conformidade de logging • Ser responsável pelo gerenciamento de secrets, pipelines de artefatos/imagens e estratégias de implantação blue/green ou rolling • Operar o pipeline de OpenTelemetry, do SDK ao Collector e CloudWatch, utilizando Langfuse para traces de LLM • Manter a infraestrutura de utilização e custos por tenant, dashboards da plataforma, alertas e SLOs • Manter a retenção e o mascaramento de traces de acordo com os padrões de governança de dados • Apoiar as equipes de produto em questões relacionadas a ambientes, dúvidas sobre deploy e investigação de problemas de performance • Manter a postura de segurança para apoiar os compromissos de SOC 2, HIPAA e GDPR por meio de IAM com privilégio mínimo, isolamento de rede, criptografia e trilhas de auditoria • Apoiar a arquitetura de mascaramento de PII no nível da infraestrutura

🎯 Requisitos

• Mais de 5 anos de experiência em funções de platform, SRE ou DevOps, operando workloads de produção na AWS (experiência com outras plataformas de cloud é desejável) • Experiência prática avançada com ECS (ou EKS), RDS, ElastiCache, S3, CloudWatch, IAM e redes VPC • Forte experiência com infraestrutura como código utilizando Terraform ou CDK • Responsabilidade por CI/CD utilizando GitHub Actions, GitLab CI ou ferramentas similares • Experiência com Claude Code e AI Spec Driven Design • Experiência na operação de sistemas open source stateful em produção, incluindo ClickHouse ou bancos colunares/analíticos comparáveis, como Druid ou Pinot; alternativamente, experiência sólida e transferível em operações de bancos de dados com Postgres em escala, Elasticsearch ou Kafka • Conhecimento prático de OpenTelemetry, incluindo collectors, exporters, sampling e convenções de instrumentação • Abordagem security-first para políticas de IAM, secrets e limites de dados • Experiência com múltiplos provedores de cloud (AWS, Azure e GCP) é desejável • Experiência com hospedagem própria de ferramentas de LLM/GenAI, como Langfuse, LiteLLM ou vLLM, ou com a operação de workloads de GenAI, como Bedrock e gerenciamento de custos de tokens, é desejável • Fluência em scripting/automação com Python ou Go é desejável • Experiência prévia em ambientes orientados à conformidade, envolvendo auditorias SOC 2, HIPAA ou residência de dados conforme o GDPR, é desejável • Experiência com operações de SaaS multi-tenant, incluindo isolamento de tenants, medição por tenant e gerenciamento de noisy neighbors, é desejável • Experiência em FinOps com alocação de custos da AWS, estratégias de tagging e atribuição de custos por tenant é desejável

Candidatar-se

Vagas Similares

🕒 Agosto 21

VALCE Talent Solutions

11 - 50

🤝 B2B

🎯 Recrutamento

💼 Consultoria

AI Engineer monitoring and governing production AI models and agents for Techmahindra in Mexico. Managing MLOps, incidents, compliance, and cloud platform integrations.

🇲🇽 México – Remoto

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🏗️ Engenheiro de Plataforma

🗣️🇪🇸 Espanhol obrigatório

🕒 Julho 27

Apptegy

201 - 500

📚 Educação

☁️ SaaS

Senior Full Stack Engineer on Apptegy’s Platform Engineering team building secure and scalable foundational products for educational technology. Focus on solving cross-cutting technical problems using Vue.js and Ruby on Rails.

🇲🇽 México – Remoto

💰 $13.181.851 Venture Round - Apptegy em 2019-03

⏰ Tempo Integral

🟠 Sênior

🏗️ Engenheiro de Plataforma

🗣️🇺🇸🇬🇧 Inglês obrigatório