Platform Site Reliability Engineer

Vaga não está no LinkedIn

🕒 2 dias atrás

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $165.000 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

👻 Score fantasma 0%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of First Due

First Due

201 - 500 funcionários

Fundada em 2016

☁️ SaaS

🏛️ Governo

🤝 B2B

💰 $355.000.000 Private Equity Round - First Due em 2025-08

SaaS • Government • B2B

A First Due é uma empresa de software que fornece ferramentas baseadas em nuvem para planejamento pré-incidente, mapeamento e conscientização situacional para departamentos de bombeiros, serviços médicos de emergência (EMS) e outros respondentes a emergências. Sua plataforma centraliza dados de edificações, localizações de hidrantes, avaliações de risco e detalhes operacionais e integra-se com sistemas de despacho/CAD para melhorar a resposta a incidentes, alocação de recursos e redução de riscos comunitários. A First Due vende sua plataforma como uma assinatura/serviço para agências de segurança pública e governos municipais.

Descrição

• Design, implement, and maintain scalable, secure, and highly available cloud infrastructure • Build and manage infrastructure-as-code solutions for repeatable and reliable deployments • Improve platform reliability, resiliency, scalability, and performance • Partner with engineering teams on reliability and observability • Support disaster recovery, backup, and business continuity initiatives • Design, implement, and maintain CI/CD pipelines • Automate operational tasks and improve deployment processes • Streamline development workflows and reduce operational overhead • Improve release management practices and deployment strategies • Champion DevOps best practices across the organization • Monitor production systems and identify availability and performance improvements • Participate in incident response, troubleshooting, root cause analysis, and post-incident reviews • Develop and maintain monitoring, alerting, logging, and observability solutions • Define and monitor SLOs, SLIs, and reliability metrics • Support on-call rotations and critical production incidents • Implement secure infrastructure practices with Security and Engineering teams • Support vulnerability remediation, patch management, access controls, and security monitoring • Assist with compliance initiatives and infrastructure controls • Ensure adherence to security, privacy, and operational best practices • Collaborate with Engineering, Product, QA, and Security teams • Document infrastructure, operational processes, and technical standards • Improve reliability, efficiency, developer experience, and operational excellence • Contribute to technical discussions, architectural reviews, and long-term platform strategy • Drive consensus on standards and develop the organizational golden path

🎯 Requisitos

• 5+ years of experience in Site Reliability Engineering, DevOps, Cloud Infrastructure, Platform Engineering, or a related role • Strong experience managing and supporting production cloud environments • Experience building and maintaining CI/CD pipelines and deployment automation • Strong understanding of infrastructure-as-code principles and tooling • Experience troubleshooting production systems and resolving complex operational issues • Knowledge of networking, security, scalability, and high-availability architectures • Strong scripting or automation experience using languages such as Python, Bash, PowerShell, or similar • Experience working closely with software engineering teams throughout the software development lifecycle • Strong analytical, problem-solving, and communication skills • Ability to balance operational stability with delivery speed and business priorities • Experience supporting high-growth SaaS platforms • Experience with AWS, Azure, or Google Cloud Platform • Experience with Kubernetes, Docker, and containerized environments • Experience with Terraform, Pulumi, CloudFormation, or other infrastructure-as-code tools • Experience with GitHub Actions, GitLab CI/CD, Jenkins, CircleCI, or similar automation platforms • Experience with Datadog, New Relic, Grafana, Prometheus, Splunk, or similar observability tools • Experience with Database Operations, Database Scacling, Query Optimization, and BCDR • Experience implementing zero-downtime deployments • Familiarity with security frameworks, compliance requirements, and operational governance practices • Experience building highly available, mission-critical applications and services • Experience supporting distributed and remote engineering organizations • All applicants must be authorized to work for any US employer in the United States • Locality Media LLC is unable to sponsor or transition sponsorship ownership of employment visas • Successful completion of a criminal background check is required

🏖️ Benefícios

• Bonus • Medical coverage • Dental coverage • Vision coverage • FSA/HSA • 401(k) • Flexible PTO • Fully remote workplace • Technology stipend • Opportunities for advancement • Minimal travel expectations • Reasonable accommodation during employment and interview process

Candidatar-se

Vagas Similares

🕒 2 dias atrás

Environmental Management Authority

51 - 200

🏥 Saúde

🛡️ Seguros

💼 Consultoria

DevOps Engineer building Kubernetes, cloud, and deployment infrastructure for Ema’s agentic AI platform. Ensuring secure, observable, reliable scaling for enterprise workflows.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 4 dias atrás

ICF

5001 - 10000

💼 Consultoria

🏛️ Governo

🏥 Saúde

Lead DevOps Engineer operating multi-account AWS and Kubernetes platforms for ICF, a global advisory and technology services provider. Automating secure, observable enterprise application delivery.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $131.256 - $223.134 / ano

💰 $29.000.000 Grant em 2023-03

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 4 dias atrás

Mastercam

201 - 500

🚘 Automotivo

💼 Consultoria

📦 Logística

DevSecOps Security Engineer securing Mastercam’s cloud-native manufacturing software, infrastructure, and AI platforms. Integrating Kubernetes, CI/CD, identity, and application security controls.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 5 dias atrás

C&S Informática

51 - 200

💼 Consultoria

🏥 Saúde

📣 Marketing

Senior DevOps Engineer diseñando CI/CD e infraestructura cloud, on-premise, edge y air-gapped. C&S Informática ofrece soluciones de software, capacitación y consultoría tecnológica.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🗣️🇪🇸 Espanhol obrigatório

🕒 5 dias atrás

DraftKings Inc.

1001 - 5000

🎲 Jogos de Azar

⚽ Esportes

Database Reliability Engineer building automated, self-healing database infrastructure for DraftKings’ real-time sports betting and gaming platform. Improving reliability, scalability, performance, and cloud operations.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $112.000 - $140.000 / ano

⏰ Tempo Integral

🟢 Júnior

🟡 Pleno

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🚫👨‍🎓 Sem graduação necessária

🗣️🇺🇸🇬🇧 Inglês obrigatório