Engenheiro de Confiabilidade de Site (Site Reliability Engineer)

Vaga não está no LinkedIn

🕒 Julho 31

🌐 Estados Unidos, Argentina, +6 outros países – Remoto

infoinfo

⏳ Contrato/Temporário

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

👻 Score fantasma 18%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Outpost

Outpost

51 - 200 funcionários

Fundada em 2021

🚗 Transporte

📦 Logística

🏠 Imobiliário

Transport • Logistics • Real Estate

A Outpost é uma empresa de tecnologia que oferece locais estratégicos para estacionamento de caminhões, posicionamento de frotas e revezamento de carretas, facilitando o movimento contínuo de cargas pelos Estados Unidos. Sua rede nacional em rápida expansão de pátios seguros apoia empresas de transporte, desde grandes frotas até proprietários-operadores, maximizando a utilização de propriedades e melhorando a eficiência operacional. Ao fazer parceria com proprietários de pátios, a Outpost permite melhores retornos sobre investimentos enquanto aprimora a infraestrutura logística essencial para a cadeia de suprimentos.

Descrição

• Ser responsável por metas de confiabilidade em nosso backend/API, serviços de worker, aplicações e pipeline de CV; MTD, MTM, MTR, e acompanhamento das causas raízes. • Elevar nosso monitoramento e alertas, e desenvolver auto-remediação, para que a carga de on-call escale por automação e não por aumento de headcount. • Atuar em parceria com nosso trabalho de engenharia com agentes (agentic engineering) para construir agentes que triem alertas e realizem remediação rotineira. • Fortalecer e otimizar nossa infraestrutura GCP (Cloud Run, Cloud SQL, GCS) visando custo e performance conforme a carga aumenta. • Ser responsável pela escalabilidade e performance do banco de dados; pooling de conexões, otimização de queries e indexação, réplicas de leitura e planejamento de capacidade, para que o Postgres não se torne gargalo com o crescimento do volume de dados. • Melhorar a confiabilidade da nossa infraestrutura de treinamento e monitoramento de ML, em parceria com a equipe de CV/ML. • Conduzir postmortems sem culpabilização (blameless) e implementar correções para as causas raiz, não apenas tratar sintomas. • Participar da rotação de on-call.

🎯 Requisitos

• 4+ anos em função de SRE, infraestrutura ou engenharia backend com responsabilidade de on-call em produção. • Experiência profunda com um grande provedor de nuvem (GCP preferido): recursos de computação, bancos gerenciados, armazenamento de objetos e networking. • Experiência na construção de stacks de monitoramento/alertas/observabilidade (Grafana, Prometheus, Zabbix, Datadog ou similares). • Fortes habilidades de scripting/automação (Python, Bash ou similares). • Confortável com workloads containerizados (Docker) e pipelines de CI/CD. • Histórico comprovado de redução do volume de incidentes ou melhoria de métricas de confiabilidade — não apenas resposta a incidentes. • Fortes habilidades de comunicação, confortável trabalhando com stakeholders técnicos e não técnicos; sabe quando e como escalar a urgência e como construir relações de trabalho sólidas entre equipes. • Fortes habilidades de comunicação em inglês — você escreve com clareza e se comunica bem de forma assíncrona.

🏖️ Benefícios

• Plano de saúde • Contribuição equivalente ao 401(k) (401(k) matching) • Horário de trabalho flexível • Folga remunerada (Paid time off)

Candidatar-se

Vagas Similares

🕒 Julho 29

Staq.io

51 - 200

💳 Fintech

🏦 Bancário

☁️ SaaS

Senior DevOps Engineer responsible for managing cloud infrastructure and optimizing deployment processes for a fintech company. Leading CI/CD improvements, logging, monitoring, and security practices.

🇺🇸 Estados Unidos – Remoto (EUA)

💰 Seed em 2023-08

⏳ Contrato/Temporário

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 28

Mento

51 - 200

☁️ SaaS

👥 RH Tech

🤝 B2B

Mento coach providing one-on-one support and guidance to members through coaching sessions. Leading ongoing training to enhance skills and improve member engagement in a remote setup.

🇺🇸 Estados Unidos – Remoto (EUA)

💰 $5.950.000 Seed Round - Mento em 2023-02

⏳ Contrato/Temporário

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 22

Arctiq

201 - 500

💼 Consultoria

🏥 Saúde

📦 Logística

Senior Site Reliability Engineer architecting reliability strategies for large-scale government systems. Leading implementation of SRE framework and mentoring mid-level engineers toward system resilience.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 17

Leland

11 - 50

💼 Consultoria

📣 Marketing

📚 Educação

Site Reliability & Engineering Coach for a remote platform connecting people to career experts. Focusing on practical skill development in site reliability engineering and career support.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Junho 24

Black Pearl Consult

11 - 50

💼 Consultoria

🎯 Recrutamento

DevOps Engineer focusing on automating deployment pipelines and managing cloud infrastructure for technology company. Collaborating with engineering and cloud teams to improve deployment speed and reliability.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $750 - $1.500 / mês

⏳ Contrato/Temporário

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório