Senior Cloud Ops Engineer – SRE

🕒 Julho 17

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $90.000 - $125.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of CaseWorthy, Inc.

CaseWorthy, Inc.

51 - 200 funcionários

🏥 Saúde

💼 Consultoria

📦 Logística

Healthcare • Consulting • Logistics

CaseWorthy, Inc. é uma plataforma de gestão de casos essencial para a missão, projetada para oferecer um cuidado abrangente e relatórios de resultados para serviços sociais e humanos. Ela proporciona gerenciamento centralizado de dados através de sua plataforma CORE, permitindo que as organizações otimizem operações, melhorem a prestação de serviços e obtenham uma visão abrangente dos dados de clientes e programas. CaseWorthy apoia uma vasta gama de programas e capacita organizações a transformarem comunidades, oferecendo soluções adaptadas às necessidades em serviços para idosos, saúde comportamental, serviços para veteranos, entre outros. Com um forte foco em insights baseados em dados e eficiência operacional, CaseWorthy visa capacitar organizações de saúde e serviços humanos a realizarem suas missões através de tecnologia inovadora.

Descrição

• Maintain and improve the company's Azure cloud infrastructure with a focus on reliability, availability, and performance. • Define, track, and report on SLIs, SLOs, and error budgets for production services. • Provide on-call, after-hours support on a rotating schedule, including incident response and escalation. • Lead and participate in blameless postmortems and retrospectives of production infrastructure incidents, driving corrective and preventive action items to closure. • Perform hosting tasks as needed including deployments and patching. • Automate infrastructure and configuration management using Infrastructure as Code (IaC). • Maintain and execute new tenant site provisioning. • Plan and execute database migrations to accommodate capacity plans. • Build and maintain observability tooling — metrics, logs, traces, dashboards, and alerting — using Datadog and Azure Monitor to enhance security, observability, and monitoring of workloads (compute, data storage, application integration elements). • Perform capacity planning and load/performance analysis to anticipate and prevent reliability issues before they impact customers. • Contribute to the organization's security audits and risk assessments. • Assist with vulnerability scans / penetration tests for internal and client systems. • Assist with identifying, documenting, and socializing application risks and vulnerabilities. • Use Azure services such as Azure Virtual Machines, Azure Kubernetes Service (AKS), Azure Functions, Azure SQL Database / Azure SQL Managed Instance, Azure Cosmos DB, Azure Blob Storage, Azure API Management, and Azure DNS, to name a few. • As well as Azure DevOps Pipelines / GitHub Actions, Azure Resource Manager (ARM) templates / Bicep, Checkmarx, Tenable, Datadog, Azure Monitor, and Atlassian products. • Ability to travel nationwide, up to 10% annually. • Perform other duties as assigned.

🎯 Requisitos

• 3+ years of experience working with public cloud infrastructure, specifically Microsoft Azure. • Background in site reliability engineering (SRE), DevSecOps, or software development. • Hands-on experience with observability and monitoring platforms, specifically Datadog and Azure Monitor. • Working knowledge of SRE fundamentals — SLIs, SLOs, error budgets, incident response, and blameless postmortems. • Experience with deployment pipeline automation tools. • Experience with scripting languages (Python, PowerShell). • Basic knowledge of SQL. • B.S. in IT, Computer Science, or related field. • Experience with Azure-hosted environments. • Familiarity with Windows systems administration. • Experience with container orchestration (Azure Kubernetes Service / Kubernetes). • Microsoft Azure certifications (e.g., AZ-104, AZ-400, AZ-500) are a plus. • Datadog certification is a plus. • Experience with AWS or GCP is a plus, given transferable public cloud skills. • M.S. in IT, Computer Science, or related field.

Candidatar-se

Vagas Similares

🕒 Julho 17

Siemens Healthineers

10.000+ funcionários

🏥 Saúde

⚕️ Seguro de Saúde

🧬 Biotecnologia

Network Engineer responsible for cloud solutions operations at Varian. Collaborating across teams to enhance, optimize, and maintain cloud computing capabilities.

🇺🇸 Estados Unidos – Remoto (EUA)

💰 $1.500.000 Grant em 2021-05

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

Cloud

Firewalls

Switching

TCP/IP

🕒 Julho 17

Siemens Healthineers

10.000+ funcionários

🏥 Saúde

⚕️ Seguro de Saúde

🧬 Biotecnologia

Network Engineer managing cloud operations and support for Varian’s cloud solutions. Enhancing, optimizing, and maintaining computing capabilities across the global cloud solution.

🇺🇸 Estados Unidos – Remoto (EUA)

💰 $1.500.000 Grant em 2021-05

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

Azure

Citrix

Cloud

Firewalls

Switching

TCP/IP

🕒 Julho 16

Miris

11 - 50

☁️ SaaS

🥽 AR/VR

🤝 B2B

Site Reliability Engineer building scalable platforms for 3D/4D content delivery at Miris. Collaborating with teams to ensure system reliability and performance across AR/VR devices.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $102.693 - $287.488 / ano

💰 $26.000.000 Seed Round - MIRIS em 2024-08

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 16

Epic Kids

11 - 50

📚 Educação

👥 B2C

📱 Mídia

Senior Site Reliability Engineer driving reliability and stability for Epic Kids' GCP infrastructure. Collaborating with product and data teams to ensure platform efficiency and security.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $160.000 - $200.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 16

Global Alliant Inc

51 - 200

💼 Consultoria

🏥 Saúde

📦 Logística

Fullstack DevSecOps Engineer developing enterprise applications on AWS. Collaborating in Agile environments with strong focus on secure coding practices.

🗣️🇺🇸🇬🇧 Inglês obrigatório