DevOps Engineer II – IT Infrastructure Systems

🕒 4 dias atrás

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Golden 1 Credit Union

Golden 1 Credit Union

1001 - 5000 funcionários

Fundada em 1933

🏦 Bancário

💸 Finanças

Banking • Finance

A Golden 1 Credit Union é uma cooperativa de crédito pertencente aos membros e está sediada em Sacramento, Califórnia. Oferece serviços bancários de varejo e empresariais, além de uma ampla gama de serviços financeiros ao consumidor, incluindo múltiplas opções de contas correntes e poupança, certificados de prazo e IRAs, produtos de hipoteca e home equity, empréstimos pessoais e para automóveis, cartões de crédito, serviços de investimento e gestão de patrimônio, e opções de seguros e proteção. A cooperativa de crédito enfatiza ferramentas de banco online e móvel, programas de recompensas para membros e cashback, educação financeira, subsídios e bolsas de estudo para a comunidade, e parcerias (por exemplo, com o Golden 1 Center/Sacramento Kings).

Descrição

• Independently lead infrastructure-as-code development using Terraform and scripting languages such as Python and PowerShell to support scalable and reliable deployments. • Manage Linux/Kubernetes cluster environments. • Deploy solutions in accordance with Change Management Processes. • Support development teams on API integration strategy and standards development. • Ensure systems are secure against cybersecurity threats. • Identify technical problems and develop software updates and fixes. • Strong Splunk skills for administration, query optimization, alerting, and dashboard development. • Build tools to reduce errors and improve customer experience. • Propose ideas and solutions within the Infrastructure Department to reduce workload through automation. • Design, implement, and optimize CI/CD pipelines for faster and more reliable software releases. • Independently conduct root cause analysis and implement corrective actions. • Design and write tests to investigate infrastructure failure and scaling. • Create and maintain response playbooks across incident management and monitoring tools. • Develop automation to ensure repeatability, eliminate toil, and reduce time to action and repair services. • Analyze key operational metrics to identify opportunities to improve availability. • Implement effective monitoring, alerting, and reduction of alert fatigue. • Manage container orchestration environments and optimize deployment workflows to enhance scalability, reliability, and operational efficiency. • Design, build, and manage containerized environments using Docker. • Create and maintain SLIs, SLOs, and error budgets. • Design and optimize monitoring dashboards and alerting systems to proactively detect and address application performance and uptime issues. • Implement code branching strategies using GitHub functions. • Advanced Terraform syntax and GitLab CI/CD configuration, pipelines, jobs. • Provisioning and setting up metrics in Prometheus, Thanos, and Grafana, creating and managing alerts. • Implement cloud engineering standards, reusable modules, and platform patterns in Microsoft Azure. • Operate shared cloud platform services according to Cloud Engineering defined architectures. • Ensure infrastructure changes comply with reliability, security, and cost controls established by Cloud Engineering. • Maintain operational documentation and runbooks for cloud platform services.

🎯 Requisitos

• Over 4 years as a DevOps Engineer in medium to large-scale environments. • Proficient in Windows Server, Linux, and hybrid cloud deployments using Microsoft Azure and VMWare. • Skilled in Git/GitHub workflows, Terraform, Python, PowerShell, and container orchestration (Tanzu, Docker, Kubernetes, OpenShift). • Experienced with CI/CD tools (Jenkins, GitLab CI, Azure DevOps) and observability platforms (Datadog, Prometheus, Grafana, ThousandEyes). • Knowledgeable in log management (ELK Stack) and database technologies (PostgreSQL, MySQL, NoSQL). • Strong background in automating infrastructure provisioning and application deployment using Terraform, Ansible, and Kubernetes. • Proficient in creating and maintaining monitoring dashboards, SLIs, SLOs, and error budgets to ensure application uptime and performance. • Experienced in ensuring infrastructure security, driving automation initiatives, and collaborating across teams to improve reliability and scalability. • Experienced in building observability pipelines and performing advanced queries in log management tools like Splunk for troubleshooting. • Experience implementing and operating Azure-based shared services defined by platform or cloud engineering teams. • Microsoft Azure DevOps Engineer Expert Certification (Required). • Kubernetes Administration Certification (Required). • Linux Certification (Desired).

Candidatar-se

Vagas Similares

🕒 4 dias atrás

Counterpart Health

51 - 200

🏥 Saúde

🤖 Inteligência Artificial

☁️ SaaS

Senior Site Reliability Engineer at Counterpart Health improving infrastructure for healthcare delivery. Collaborating with teams on containerized solutions and automation tools.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $160.000 - $208.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 4 dias atrás

National Trust

10.000+ funcionários

🤲 Filantropia

🏨 Hospitalidade

🛒 Varejo

DevSecOps Engineer III at National Digital Trust Company securing digital asset infrastructure. Lead modernization in CI/CD, security controls, and cloud-native systems.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 4 dias atrás

PayNearMe

201 - 500

💳 Fintech

☁️ SaaS

🤝 B2B

Site Reliability Engineer at PayNearMe, Inc. responsible for infrastructure management and application reliability. Collaborating with cross-functional teams to enhance system performance and incident response.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $180.000 - $200.000 / ano

🔥 Investimento no último ano

💰 $50.000.000 Series E - PayNearMe em 2025-09

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 4 dias atrás

Made4net

51 - 200

📦 Logística

☁️ SaaS

🏢 Corporativo

Cloud Operations Engineer supporting AWS infrastructure for supply chain software solutions. Monitoring systems and ensuring reliability in a global operations team.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $120.000 / ano

💰 Private equity em 2021-02

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 4 dias atrás

Sycurio

51 - 200

☁️ SaaS

🔐 Segurança

📋 Conformidade

Deployment Engineer for Sycurio solutions deployment and testing. Involves supporting installations and training customer support engineers.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório