Engenheiro(a) Sênior de DevOps

🔥 1 hora atrás

🌐 Argentina, Polônia, +2 outros países – Remoto

info

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Solvd, Inc.

Solvd, Inc.

501 - 1000 funcionários

Fundada em 2010

💼 Consultoria

🏥 Saúde

📦 Logística

Consulting • Healthcare • Logistics

Solvd, Inc. é uma empresa global de engenharia de software e consultoria que entrega soluções completas end-to-end. Fundada em 2011, a Solvd oferece serviços centrais de engenharia, incluindo desenvolvimento de software para plataformas web e mobile, experiência digital e design, soluções de Data e AI/ML e modernização de plataformas em cloud. A empresa é parceira da AWS e é reconhecida por otimizar recursos, resolver problemas complexos e elevar a satisfação dos usuários. A Solvd enfatiza inovação e Quality Assurance (QA), empregando mais de 800 profissionais internacionais em 8 escritórios pelo mundo. A empresa se orgulha de transformar negócios ao fornecer produtos digitais ricos em funcionalidades, testes manuais, automação e soluções tecnológicas de ponta. Suas ferramentas proprietárias, como Zebrunner e Carina, ajudam a aprimorar os processos de desenvolvimento e QA. A Solvd opera com foco em colaboração, atração e desenvolvimento de talentos de alto nível e soluções técnicas personalizadas às necessidades de cada cliente, atendendo clientes em 15 países.

Descrição

• Projetar, implementar e manter infraestrutura em nuvem segura, confiável e escalável. • Construir e aprimorar pipelines CI/CD que suportem implantações frequentes, repetíveis e de baixo risco. • Automatizar provisionamento de infraestrutura, configuração, deployment e gerenciamento de ambientes. • Manter infraestrutura como código usando ferramentas como Terraform, CloudFormation, Pulumi ou tecnologias comparáveis. • Melhorar a consistência entre ambientes de desenvolvimento, teste, staging e produção. • Construir e manter ambientes de aplicações conteinerizadas e capacidades de orquestração. • Implementar e aprimorar monitoramento, logging, tracing, alertas, dashboards e relatórios de saúde da produção. • Trabalhar em parceria com engenheiros para estabelecer SLIs, SLOs e métricas operacionais acionáveis. • Aprimorar resiliência, escalabilidade, disponibilidade e prontidão para recuperação de desastres de aplicações e infraestrutura. • Gerenciar secrets, certificados, identidades, permissões, controles de rede e configurações de segurança na nuvem. • Apoiar gerenciamento de vulnerabilidades, segurança de dependências, aplicação de patches e hardening da infraestrutura. • Aprimorar estratégias de deployment, incluindo rollback automatizado, blue-green deployments e canary releases. • Diagnosticar e resolver incidentes de produção envolvendo infraestrutura, rede, deployment de aplicações, desempenho, capacidade ou serviços em nuvem. • Participar de resposta a incidentes, análises pós-incidente, análise de causa raiz e planejamento de ações corretivas. • Reduzir desperdício em nuvem e melhorar a visibilidade de custos da infraestrutura. • Construir ferramentas de self-service e padrões de deployment reutilizáveis para times de engenharia de aplicações. • Documentar arquitetura de infraestrutura, procedimentos operacionais, processos de recuperação e orientações de troubleshooting. • Participar do suporte de produção e de um esquema de plantão (on-call) apropriado. • Utilizar ferramentas de engenharia assistidas por IA para acelerar scripting, troubleshooting, documentação e análise de infraestrutura.

🎯 Requisitos

• Approximately 5+ years of experience in DevOps, SRE, Cloud Engineering, Platform Engineering, or closely related role. • Strong experience operating production workloads in AWS. • Strong hands-on experience with infrastructure as code (Terraform, CloudFormation, Pulumi). • Experience building and maintaining CI/CD pipelines (GitHub Actions, GitLab CI, Jenkins, CircleCI, AWS CodePipeline). • Strong knowledge of Docker and containerized application delivery. • Experience with Kubernetes, Amazon ECS, or another container orchestration platform. • Strong understanding of cloud networking (VPCs, subnets, routing, load balancers, DNS, firewalls, gateways, private connectivity). • Experience with cloud IAM, role-based access, least-privilege design, and secrets management. • Experience implementing logging, metrics, dashboards, alerts, and distributed tracing. • Familiarity with observability platforms (Datadog, New Relic, Grafana, Prometheus, CloudWatch, OpenTelemetry). • Strong Linux and command-line skills. • Scripting experience with Python, Bash, JavaScript, or comparable language. • Understanding of application deployment patterns for modern web applications, APIs, background workers, and event-driven systems. • Experience supporting relational databases, backups, restore processes, high availability. • Knowledge of incident-management practices, root-cause analysis, capacity planning, and production-readiness reviews. • Working knowledge of cloud security, vulnerability remediation, encryption, certificates, key management, and compliance-oriented controls.

🏖️ Benefícios

• Be part of a global team with equal opportunities for collaboration across continents and cultures. • Thrive in an inclusive environment that prioritizes continuous learning, innovation, and ethical AI standards.

Candidatar-se

Vagas Similares

🕒 Ontem

intive

1001 - 5000

💼 Consultoria

🏥 Saúde

📣 Marketing

DevOps / Cloud Engineer supporting Azure infrastructure and cloud operations at intive. Managing cloud infrastructure, CI/CD pipelines, and ensuring best practices in a dynamic environment.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 2 dias atrás

Teladoc Health

5001 - 10000

🏥 Saúde

👥 B2C

☁️ SaaS

Site Reliability Engineer at Teladoc Health specializing in Azure observability and monitoring. Ensuring reliability and performance of hybrid cloud infrastructure and services.

🇦🇷 Argentina – Remoto

💰 $80.000.000 Post-IPO Debt - Teladoc Health em 2016-07

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 2 dias atrás

Domus Global

501 - 1000

💼 Consultoria

📣 Marketing

📦 Logística

DevOps Engineer designing and optimizing AWS infrastructure and CI/CD processes at Nublit. Responsible for automation and continuous improvement in development teams.

🇦🇷 Argentina – Remoto

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇪🇸 Espanhol obrigatório

🕒 3 dias atrás

Cognativ

11 - 50

💼 Consultoria

🥽 AR/VR

🤖 Inteligência Artificial

Senior Site Reliability Engineer ensuring stability of distributed AI alerting platform. Leading incident response, capacity planning, and observability with a focus on service reliability.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 24

Software Mind

1001 - 5000

🤖 Inteligência Artificial

☁️ SaaS

📡 Telecomunicações

DevOps Engineer designing Infrastructure as Code and automating deployment processes for a multicultural engineering team at Software Mind. Collaborating on CI/CD pipelines while ensuring system observability and security compliance.

🇦🇷 Argentina – Remoto

💰 Private Equity Round em 2020-12

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório