Senior Database Reliability Engineer

🕒 Agosto 26

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $220.000 - $240.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

👻 Score fantasma 20%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Prompt Therapy Solutions Inc

Prompt Therapy Solutions Inc

11 - 50 funcionários

🏥 Saúde

💼 Consultoria

📦 Logística

Healthcare • Consulting • Logistics

A Prompt Therapy Solutions Inc. é uma empresa que fornece soluções de software focadas em terapia, projetadas para aumentar a eficiência e a rentabilidade de clínicas. Oferecem uma gama de funcionalidades, incluindo agendamentos com suporte de IA, gerenciamento de pacientes, ferramentas de faturamento e relatórios. Sua plataforma atende a diversos tamanhos de práticas, desde clínicas iniciantes até grandes empresas, visando otimizar as operações das clínicas e melhorar a satisfação dos pacientes. As soluções de IA da empresa ajudam a agilizar os fluxos de trabalho para funções como recepcionistas, terapeutas, faturistas e proprietários de clínicas. Através de análises avançadas e processos automatizados, a Prompt Therapy Solutions busca modernizar a gestão de práticas e impulsionar o crescimento dos prestadores de terapia.

Descrição

• Own the reliability, performance, and availability of production Aurora MySQL databases on AWS across EHR, Data, and AI teams • Manage database alerting end to end and maintain the observability pipeline feeding metrics and alerts into Datadog • Integrate after-hours database alerts into the DevOps on-call rotation • Educate and train engineering teams on database hygiene and high-performing queries • Implement safeguards such as automatic termination of long-running or runaway queries • Provide fast, always-available visibility into queries executing on any database instance • Author and maintain database runbooks for rapid, consistent incident response • Diagnose, optimize, and re-index problematic queries to reduce latency and scale-out load • Review EMR and application queries before release as a performance gate • Architect and right-size Aurora reader topology and read-routing strategy • Own database cost efficiency through instance right-sizing, reserved-capacity/Savings Plan strategy, and storage tiering • Manage replication health, backups, restore testing, failover, and disaster recovery • Establish safe schema-change and migration practices across teams • Partner with the Platform Architect on database workload architecture • Handle protected health information responsibly in a HIPAA-compliant environment

🎯 Requisitos

• 6+ years in database reliability engineering, database administration, or database engineering, including ownership of production systems at scale • Deep MySQL expertise, including query optimization, execution-plan analysis, indexing strategy, and replication • Aurora MySQL experience strongly preferred • Hands-on experience operating large, multi-reader Aurora or RDS clusters at terabyte scale, including read-routing and connection management • Strong command of database observability tooling, including Datadog, Percona Monitoring and Management (PMM), Performance Insights, Prometheus/Grafana • Proficiency in Python, Bash, or a similar scripting language for automation • Comfort with infrastructure-as-code, particularly Terraform • Solid AWS operational depth around RDS/Aurora, including cost optimization, instance sizing, reserved capacity, and storage types • Experience with on-call/incident response and authoring runbooks • Excellent communication skills and ability to collaborate across engineering teams • Experience with a cloud data warehouse such as Snowflake, Databricks, or Redshift preferred • Experience in a HIPAA-regulated or other compliance-heavy environment handling sensitive data preferred • Familiarity with query auto-remediation tooling such as pt-kill, Percona Toolkit, statement timeouts, or custom killers preferred • Application-side familiarity with PHP preferred • Knowledge of security best practices for database and cloud environments preferred • Previous experience with agile methodologies and fast-paced environments preferred • Must be legally authorized to work in the US • Must be located in the US

🏖️ Benefícios

• Potential equity compensation for outstanding performance • Flexible PTO • Company-wide sponsored lunches • Company paid disability and life insurance benefits • Company paid family and medical leave • Medical, dental, and vision insurance benefits • Discounted pet insurance • FSA/DCA and commuter benefits • 401k • Credits for online fitness classes/gym memberships • Recovery suite at HQ — includes a cold plunge, sauna, and shower • Remote/hybrid environment • Positive impact helping outpatient rehab organizations treat more patients and deliver better care

Candidatar-se

Vagas Similares

🕒 Agosto 25

ACT

501 - 1000

📚 Educação

🤝 Sem Fins Lucrativos

Senior DevOps Engineer building secure AWS, Kubernetes, and GitOps delivery platforms for ACT’s education mission. Improving automation, resiliency, observability, and cloud cost management.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $100.000 - $130.000 / ano

💰 $30.000 Grant - ACT em 2022-01

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 25

ACT

501 - 1000

📚 Educação

🤝 Sem Fins Lucrativos

Senior DevOps Engineer building secure AWS, Kubernetes, and GitOps delivery platforms for ACT’s education assessment mission. Improving automation, resiliency, observability, and cloud cost management.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $100.000 - $130.000 / ano

💰 $30.000 Grant - ACT em 2022-01

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 25

CACI International Inc

10.000+ funcionários

🎖️ Defesa

🏛️ Governo

🔒 Cibersegurança

AWS DevSecOps Engineer modernizing CACI’s federal Grant Solutions cloud platform. Automating secure infrastructure, CI/CD, observability, and compliant software delivery.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $98.500 - $206.800 / ano

🔥 Investimento no último ano

💰 $500.000.000 Post-IPO Debt em 2026-02

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 25

Bitwarden

51 - 200

🔒 Cibersegurança

☁️ SaaS

🏢 Corporativo

Senior SRE operating Bitwarden Gov’s FedRAMP-compliant cloud infrastructure. Managing reliability, monitoring, incident response, Kubernetes, and security across multi-cloud environments.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $140.000 - $185.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 25

URUS Group

1001 - 5000

🌾 Agricultura

🤝 B2B

🧬 Biotecnologia

DevOps Team Lead operating VAS’s AWS platform for farm management software. Leading IaC, reliability, security, cost optimization, and globally distributed workloads.

🗣️🇺🇸🇬🇧 Inglês obrigatório