Site Reliability Engineer

🕒 Agosto 18

🇪🇸 Espanha – Remoto

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

👻 Score fantasma 10%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of HostPapa

HostPapa

51 - 200 funcionários

Fundada em 2006

💼 Consultoria

📦 Logística

📣 Marketing

Consulting • Logistics • Marketing

HostPapa é uma empresa de hospedagem de sites que oferece uma variedade de soluções, incluindo hospedagem compartilhada, hospedagem WordPress, hospedagem VPS e hospedagem de revenda. A empresa também disponibiliza serviços adicionais, como registro de domínios, ferramentas para criação de sites, e-mail corporativo e recursos de segurança como certificados SSL. A HostPapa se orgulha de oferecer suporte ao cliente 24/7 premiado, disponível globalmente, garantindo atendimento no idioma e no fuso horário preferidos do cliente. Com foco em pequenas empresas, a HostPapa busca capacitar seus clientes a alcançar seus objetivos online com serviços de hospedagem confiáveis e de alto desempenho.

Descrição

• Define and implement SLIs, SLOs, and error budgets for critical CloudBlue services • Influence system architecture with a focus on reliability, scalability, and operability • Reduce operational toil through automation and process improvement • Design and operate the observability stack across metrics, logs, and traces • Develop alerting strategies and dashboards for platform and business health • Design and maintain high-availability architectures, redundancy, failover, and disaster recovery strategies • Conduct capacity planning, load testing, and performance optimization • Lead production incident coordination, communication, and service restoration • Own blameless postmortems and drive improvements to reduce incidents, MTTR, and customer impact • Improve reliability of Kubernetes-based platforms through health checks, autoscaling, rollout safety, and resilience testing • Partner with Engineering and DevOps teams on deployment safety, rollback strategies, and platform reliability • Maintain runbooks and operational documentation • Promote SRE best practices across engineering teams • Support other tasks or projects as assigned

🎯 Requisitos

• 3+ years of experience as an SRE, DevOps Engineer, or Production Engineer • Strong ownership of production systems • Experience operating highly available, enterprise-grade, multi-tenant SaaS platforms • Hands-on experience with Datadog, Grafana, and Elasticsearch/Kibana • Solid understanding of Linux, networking, and distributed systems fundamentals • Experience with Docker and Kubernetes • Strong scripting and automation skills using Python and/or Bash • Experience participating in on-call rotations and production incident response • Strong written and spoken English • Cloud experience, preferably with Azure; AWS and/or GCP experience valued • Experience with hybrid or on-premises integrations beneficial • Experience defining SLIs/SLOs and managing error budgets, hyperscale/service-provider-grade platforms, chaos engineering, and resilience testing are advantageous or considered assets

🏖️ Benefícios

• A competitive salary that values you and your unique skill sets • Career advancement & professional development opportunities • Flexible work arrangements to support work/life balance • 24/7 award-winning customer support • Diversity and inclusion • Accommodation may be provided in all parts of the hiring process

Candidatar-se

Vagas Similares

🕒 Agosto 17

Mirantis

501 - 1000

💼 Consultoria

🏥 Saúde

📦 Logística

Senior SRE deploying and operating Kubernetes-based AI infrastructure on NVIDIA-certified hardware for Mirantis, a cloud-native infrastructure company. Improving reliability, security, scalability, and automation.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 14

Devoteam

5001 - 10000

💼 Consultoria

🏥 Saúde

📣 Marketing

Data AWS DevSecOps professional evolving secure cloud data platforms for Devoteam’s large-organization clients. Advising teams on architecture, security, governance and observability in a remote Spain-based role.

🇪🇸 Espanha – Remoto

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 14

Logicalis Spain

1001 - 5000

💼 Consultoria

DevOps Engineer operando y automatizando plataformas Kubernetes para Logicalis Spain, proveedor de servicios IT empresariales. Mejorando CI/CD, infraestructura cloud y servicios gestionados.

🇪🇸 Espanha – Remoto

💵 €40.000 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇪🇸 Espanhol obrigatório

🕒 Agosto 14

Tempo Software

201 - 500

☁️ SaaS

🏢 Corporativo

⚡ Produtividade

Senior Site Reliability Engineer building AWS infrastructure, CI/CD pipelines, and Kubernetes platforms for Tempo’s enterprise productivity software. Automating reliability, observability, security, and cloud deployments.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 7

Affirm

1001 - 5000

💳 Fintech

👥 B2C

🛍️ Comércio Eletrônico

Senior SRE strengthening reliability for Affirm’s honest, flexible buy-now-pay-later platform. Building incident lifecycle, observability and resilient backend practices for global engineering teams.

🇪🇸 Espanha – Remoto

💵 €86.000 - €122.000 / ano

💰 Post-IPO Equity em 2021-01

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório