Engenheiro(a) de Platform Engineering Sênior/Staff

Vaga não está no LinkedIn

🔥 17 horas atrás

🌐 Canadá, Brasil, +1 outros países – Remoto

infoinfo

⏰ Tempo Integral

🟠 Sênior

🏗️ Engenheiro de Plataforma

👻 Score fantasma 13%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Virtasant

Virtasant

51 - 200 funcionários

💼 Consultoria

🏢 Corporativo

🤝 B2B

Consulting • Enterprise • B2B

A Virtasant é uma empresa de serviços e otimização em cloud que ajuda empresas a migrarem para, gerenciarem e construírem em plataformas de nuvem pública. Eles combinam uma plataforma proprietária de automação com serviços gerenciados e expertise em FinOps para reduzir custos na nuvem (alegando economias médias superiores a 50%), apoiar programas de Cloud FinOps e oferecer engajamentos baseados em resultados ao invés de cobrança por hora ou por assento. A Virtasant também fornece orientação em IA empresarial e faz parceria com grandes provedores de nuvem (AWS, Google Cloud, Azure) para oferecer migração, otimização e operações gerenciadas 24/7.

Descrição

• Projetar, construir, operar e aprimorar plataformas Kubernetes de produção • Ser responsável pela arquitetura de clusters, networking, isolamento de workloads, gerenciamento de recursos, segurança, upgrades, escalabilidade e confiabilidade • Diagnosticar e solucionar problemas de Kubernetes, containers, Linux, networking e da infraestrutura subjacente • Operar e aprimorar infraestrutura de grande escala e alta disponibilidade em ambientes de cloud, híbridos, virtualizados e/ou bare metal • Desenvolver e manter ferramentas e automações de produção usando Go, Python ou Java • Criar serviços internos, APIs, integrações e ferramentas operacionais • Automatizar processos operacionais repetitivos e reduzir intervenções manuais na plataforma • Ser responsável pela confiabilidade e pela saúde operacional da infraestrutura crítica de produção • Liderar ou contribuir significativamente para a resposta a incidentes e a correção de causas-raiz • Definir e aprimorar SLOs, SLIs, alertas e processos operacionais • Utilizar logs, métricas, traces, ferramentas de profiling e diagnósticos em nível de sistema • Promover melhorias em disponibilidade, performance, capacidade, resiliência e prontidão operacional • Contribuir para o planejamento, os testes e a melhoria contínua de disaster recovery • Criar e manter infraestrutura como código usando Terraform e tecnologias relacionadas de automação • Criar e aprimorar workflows de CI/CD e deployment • Participar de migrações de cloud ou infraestrutura em produção, incluindo análise de dependências, networking, cutover, rollback e validação • Criar e manter monitoramento, métricas, dashboards, alertas, logging e distributed tracing • Trabalhar diretamente com clientes e equipes internas de engenharia para investigar problemas e desenvolver soluções técnicas • Comunicar arquitetura, decisões técnicas, riscos, trade-offs e progresso às partes interessadas técnicas • Ser responsável por iniciativas complexas de infraestrutura, desde a definição do problema até a operação em produção • Contribuir para discussões de arquitetura, RFCs, design reviews e direcionamento técnico • Mentorar engenheiros e aprimorar práticas de engenharia e operações • Atuar de forma independente em situações ambíguas e assumir a responsabilidade quando não houver direcionamento disponível

🎯 Requisitos

• Mais de 10 anos de experiência profissional em Platform Engineering, Site Reliability Engineering, Infrastructure Engineering, DevOps ou áreas relacionadas; para candidatos(as) em nível Staff, mais de 10 anos é preferível • Experiência prática significativa na operação de infraestrutura complexa de produção e sistemas distribuídos • Experiência comprovada na criação e operação de plataformas Kubernetes de produção, não apenas no deployment de aplicações em clusters existentes • Experiência de programação em produção com Go, Python ou Java • Sólida experiência com confiabilidade de produção, resposta a incidentes, troubleshooting e responsabilidade operacional • Experiência assumindo de forma independente a responsabilidade por iniciativas técnicas complexas, desde um ponto de partida ambíguo até a produção • Experiência trabalhando diretamente com stakeholders técnicos ou clientes e comunicando tópicos técnicos complexos com eficácia • Graduação em Ciência da Computação, Engenharia ou área relacionada, ou experiência prática equivalente • Conhecimento profundo de infraestrutura Kubernetes de produção, incluindo arquitetura de clusters, networking/CNI, NetworkPolicy, scheduling, gerenciamento de recursos, nodes, segurança/RBAC e comportamento de clusters • Fundamentos sólidos de Linux e experiência prática em troubleshooting de sistemas de produção • Sólido entendimento de conceitos de networking, incluindo DNS, routing, load balancing, conectividade e networking de cloud/Kubernetes • Experiência em produção com pelo menos uma das principais plataformas de cloud: AWS, GCP ou Alicloud • Infraestrutura como código em escala usando Terraform ou ferramentas equivalentes • Experiência com gerenciamento de configuração e automação utilizando tecnologias como Ansible, Puppet ou similares • Forte capacidade de debugging em produção e análise de causas-raiz em infraestrutura e sistemas distribuídos • Experiência com observabilidade usando métricas, logs, traces, dashboards e plataformas de alertas como Prometheus, Grafana, OpenTelemetry, Datadog ou equivalentes • Experiência com infraestrutura de CI/CD e práticas modernas de entrega de software • Docker e ferramentas de containers como parte do ciclo de vida de produção • Entendimento de alta disponibilidade, planejamento de capacidade, disaster recovery e resiliência de produção • Excelente comunicação técnica escrita e verbal • Forte capacidade analítica, de debugging e resolução de problemas • Alto senso de ownership e capacidade de atuar de forma independente • Conforto para tomar decisões técnicas e conduzir o trabalho em ambientes ambíguos • Capacidade de se comunicar efetivamente com clientes, engenheiros e lideranças técnicas • Forte julgamento técnico e capacidade de explicar trade-offs • Capacidade de liderar tecnicamente e influenciar outras pessoas sem autoridade formal de gestão • Conforto para trabalhar em uma equipe distribuída e altamente técnica

🏖️ Benefícios

• Trabalho totalmente remoto • Horário do Pacífico (8h às 17h, PST) • Plantão de sobreaviso a cada 4–5 semanas

Candidatar-se

Vagas Similares

🔥 19 horas atrás

Jane.app

201 - 500

🏥 Saúde

💼 Consultoria

⚕️ Seguro de Saúde

Developer Operations leader managing GitHub governance, security, and automation for Jane’s healthcare SaaS platform. Extending standardized tooling practices across Jira, Datadog, JFrog, and future SDLC systems.

🇨🇦 Canadá – Remoto

💵 $128.000 - $200.000 / ano

⏰ Tempo Integral

🟠 Sênior

🏗️ Engenheiro de Plataforma

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 12

EverCommerce

1001 - 5000

☁️ SaaS

🤝 B2B

📣 Marketing

Senior Software Engineer building cloud infrastructure and deployment systems for Invoice Simple, EverCommerce’s small-business invoicing platform. Improving reliability, observability, and production operations.

🇨🇦 Canadá – Remoto

💵 $120.000 - $150.000 / ano

💰 Private equity em 2019-08

⏰ Tempo Integral

🟠 Sênior

🏗️ Engenheiro de Plataforma

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 11

EverCommerce

1001 - 5000

🏥 Saúde

💼 Consultoria

📦 Logística

Software Engineer improving Invoice Simple’s CI/CD, cloud infrastructure, and reliability. Supporting EverCommerce’s software platform for home and field service businesses.

🇨🇦 Canadá – Remoto

💵 $110.000 - $130.000 / ano

💰 Private Equity Round em 2019-07

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🏗️ Engenheiro de Plataforma

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 14

Faire

1001 - 5000

🤝 B2B

🛍️ Comércio Eletrônico

🛒 Varejo

Senior Staff ML Platform Engineer architecting Faire’s wholesale technology platform. Defining scalable Databricks, MLOps, and machine learning infrastructure for independent retailers.

🇨🇦 Canadá – Remoto

💵 $248.000 - $341.000 / ano

⏰ Tempo Integral

🟠 Sênior

🏗️ Engenheiro de Plataforma

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 7

Midnite

201 - 500

🎲 Jogos de Azar

👥 B2C

Senior Platform Engineer strengthening backend reliability, service boundaries, and regional scalability for Midnite’s sports betting and gaming platform. Supporting the Canada launch and future market expansion.

🇨🇦 Canadá – Remoto

💵 $170.000 - $220.000 / ano

⏰ Tempo Integral

🟠 Sênior

🏗️ Engenheiro de Plataforma

🗣️🇺🇸🇬🇧 Inglês obrigatório