Site Reliability Engineer II, DBA

🕒 Agosto 28

🌐 Argentina, Colômbia, +2 outros países – Remoto

infoinfo

⏰ Tempo Integral

🟢 Júnior

🟡 Pleno

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

👻 Score fantasma 10%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Backblaze

Backblaze

201 - 500 funcionários

Fundada em 2007

🛍️ Comércio Eletrônico

🏢 Corporativo

💰 $5.000.000 Series A em 2012-07

Cloud Storage • eCommerce • Enterprise

A Backblaze é uma empresa de armazenamento em nuvem que oferece soluções de backup de dados escaláveis e seguras tanto para empresas quanto para indivíduos. Seu serviço B2 Cloud Storage oferece armazenamento de objetos compatível com S3, permitindo que os usuários protejam e gerenciem seus dados com preços transparentes. A Backblaze é especialista em serviços de backup automáticos e ilimitados para sistemas de computador, garantindo opções de proteção e recuperação de dados para os usuários, além de suportar a integração com aplicativos para funcionalidades aprimoradas.

Descrição

• Operate and maintain high-availability database systems, primarily Vitess (distributed MySQL) and Cassandra, using established architecture and runbooks • Optimize database performance through query tuning, indexing strategies, and schema design • Execute documented backup, recovery, and replication procedures and escalate architecture-level changes to senior DBA SREs • Ensure database security compliance and access control • Support availability and durability of critical services across production environments • Monitor service health using SLIs, SLOs, and error budgets, escalating issues when thresholds are at risk • Participate in on-call rotations, incident response, and post-incident reviews • Follow established ITIL/OSS processes for incident, change, problem, and capacity management • Develop automation for common operational tasks to reduce manual intervention and toil • Contribute to monitoring, logging, and alerting frameworks such as Prometheus, Grafana, Catchpoint, and ELK, and integrate runbooks with FireHydrant • Work with CI/CD pipelines, configuration management, and infrastructure as code tools including Terraform, Ansible, and Jenkins • Write Bash, Python, or Go scripts to improve system reliability and efficiency • Partner with engineering, product, and operations teams on resilient system design and operations • Assist with capacity planning and disaster recovery exercises • Work with vendors and service providers to troubleshoot service issues and track SLA performance • Document systems, share learnings, and contribute to a reliability-minded engineering culture • Contribute to playbooks, runbooks, and operational documentation • Identify recurring issues and propose long-term improvements • Promote reliability-focused practices within development and operations teams

🎯 Requisitos

• Bachelor’s degree in Computer Science, Engineering, or related field (or equivalent experience) • 2–4 years of experience in site reliability, systems engineering, or operations centered around database systems • Exposure to large-scale, production-grade systems • Solid Linux systems administration and troubleshooting skills • Familiarity with monitoring, alerting, incident response, and root cause analysis • Proficiency in at least one scripting language: Python, Bash, or Go • Understanding of Kubernetes, Docker, and microservices concepts • Knowledge of incident response and operational best practices • Hands-on experience with MySQL performance tuning, replication, and disaster recovery • Proficiency in SQL and NoSQL database management • Experience with a SaaS, service provider, or distributed systems environment • Familiarity with ITIL/OSS practices and SLO/SLAs • Experience with AWS, GCP, or Azure • Ability to work independently, take ownership, and drive projects from problem discovery through resolution

🏖️ Benefícios

• No specific benefits, perks, or compensation extras are stated in the posting • Remote work arrangement in Argentina, Colombia, Costa Rica, or Mexico

Candidatar-se

Vagas Similares

🕒 Agosto 13

Azumo

51 - 200

💼 Consultoria

🏥 Saúde

📦 Logística

Engenheiro(a) DevSecOps protegendo a infraestrutura financeira impulsionada por AI da Azumo na América Latina. Endurecimento de sistemas em nuvem, gerenciamento de vulnerabilidades e proteção de agentes de AI, além de suporte à conformidade e diligência de segurança para clientes.

🇦🇷 Argentina – Remoto

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 28

Domus Global

501 - 1000

💼 Consultoria

📣 Marketing

📦 Logística

DevOps Engineer designing and optimizing AWS infrastructure and CI/CD processes at Nublit. Responsible for automation and continuous improvement in development teams.

🇦🇷 Argentina – Remoto

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇪🇸 Espanhol obrigatório

🕒 Julho 24

Software Mind

1001 - 5000

🤖 Inteligência Artificial

☁️ SaaS

📡 Telecomunicações

DevOps Engineer designing Infrastructure as Code and automating deployment processes for a multicultural engineering team at Software Mind. Collaborating on CI/CD pipelines while ensuring system observability and security compliance.

🇦🇷 Argentina – Remoto

💰 Private Equity Round em 2020-12

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 3

Cashea

501 - 1000

💳 Fintech

🛍️ Comércio Eletrônico

👥 B2C

DevSecOps Engineer responsible for application security integration in SDLC for a fintech company. Designing and implementing secure pipelines and collaborating with engineering teams.

🇦🇷 Argentina – Remoto

💰 $750.000 Seed Round - Cashea em 2025-03

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇪🇸 Espanhol obrigatório

🕒 Junho 9

Teladoc Health

5001 - 10000

🏥 Saúde

👥 B2C

☁️ SaaS

DevOps Engineer III developing infrastructure and automating delivery for Teladoc Health products. Collaborating with development and QA teams to enhance productivity and secure systems.

🇦🇷 Argentina – Remoto

💰 $80.000.000 Post-IPO Debt - Teladoc Health em 2016-07

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório