Site Reliability Engineer

Vaga não está no LinkedIn

🕒 6 dias atrás

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Sporttrade

Sporttrade

11 - 50 funcionários

Fundada em 2017

💼 Consultoria

📣 Marketing

🎲 Jogos de Azar

💰 $36.000.000 Funding Round em 2021-06

Consulting • Marketing • Gambling

A Sporttrade é um mercado de apostas esportivas que permite aos usuários realizar, acompanhar e vender suas apostas em tempo real. Diferente das casas de apostas tradicionais, a Sporttrade utiliza um sistema exclusivo baseado em probabilidades, em vez de odds americanas, permitindo que os apostadores compreendam facilmente o valor de suas apostas. Com múltiplos criadores de mercado competindo pelos melhores preços, a Sporttrade oferece uma experiência de apostas mais refinada por meio de uma interface moderna projetada para apostas sem complicações. A plataforma visa fornecer limites altos e preços excepcionais, atendendo a apostadores sérios com mais de 21 anos.

Descrição

• Own the daily operation of the exchange trading lifecycle, including market startup and shutdown, enabling and disabling trading, pre- and post-session sanity checks, and capture of settlement, clearing, and trade-reporting artifacts • Participate in an on-call rotation for a live regulated marketplace • Lead incident response, drive incidents to resolution, author postmortems, and convert one-off fixes into runbooks and automation • Operate and improve the observability stack, including dashboards, alert quality, SLOs, and time-to-detection • Run and maintain hybrid infrastructure across Kubernetes clusters, cloud accounts, and geographically distributed on-premises datacenters • Automate infrastructure and operational procedures using Ansible, Terraform, and Jenkins pipelines, with secrets managed in HashiCorp Vault • Support the exchange data platform, including PostgreSQL, Kafka change-data-capture and streaming pipelines, Redis, backup/restore, and disaster recovery • Support market-maker and partner connectivity, conformance testing, and partner onboarding • Contribute to process improvement and establish policies and procedures for monitoring, incident management, change control, and exchange operations

🎯 Requisitos

• 5+ years of experience in a Site Reliability Engineering, DevOps, production engineering, or technical operations role supporting a 24/7 production system • Strong Linux fundamentals and scripting ability • Experience supporting and debugging Java applications in production, including stack traces, thread dumps, JVM memory, garbage collection, logs, and metrics • Solid working knowledge of TCP/IP networking, including connections, ports, routing, and firewalls • Hands-on experience operating Kubernetes in production • Experience managing infrastructure as code with Terraform and Ansible • Experience with CI/CD pipelines using Jenkins or similar • Experience with observability tooling such as Datadog, Prometheus, and Grafana, or equivalents • Track record of being on-call for critical systems • Working knowledge of SQL and relational databases; PostgreSQL preferred • Self-starter able to deliver results with minimal guidance • Comfortable working independently and with a team • Excellent communication and organizational skills, especially written incident communication and documentation • Background or interest in trading, capital markets, exchange operations, or sports betting is a plus • Familiarity with exchange protocols is a plus • Previous experience in a regulated industry is a plus • Startup experience preferred but not required

🏖️ Benefícios

• Medical, Dental, and Vision Benefits: Company pays 100% Employee premium and 50% Spouse & Dependent premiums • Short- & Long-Term Disability • Group Term Life and AD&D • Voluntary Life and AD&D • 401(k) Plan • Equity Options • Flexible time off • MacBooks issued to all employees

Candidatar-se

Vagas Similares

🕒 6 dias atrás

NVIDIA

10.000+ funcionários

🏥 Saúde

🏭 Manufatura

🤖 Inteligência Artificial

AI Tools Engineer building LLM and AI/ML systems for NVIDIA’s global GeForce NOW service. Automating incident root-cause analysis and predicting operational trends from production data.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

SitusAMC

5001 - 10000

💼 Consultoria

📦 Logística

🏠 Imobiliário

Site Reliability Engineer operating AWS cloud infrastructure for SitusAMC’s real estate technology solutions. Improving reliability, automation, observability, security, and application migrations.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $95.000 - $135.000 / ano

💰 Private equity em 2020-05

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

GE Vernova

10.000+ funcionários

💼 Consultoria

📦 Logística

🏭 Manufatura

Senior Reliability Engineer improving embedded protection, control, and software products for GE Vernova’s decarbonization mission. Driving testing, field analytics, grid reliability, and cybersecurity compliance.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $162.900 - $244.300 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

SailPoint

1001 - 5000

💼 Consultoria

🏥 Saúde

📦 Logística

Senior Staff DevOps Engineer scaling AWS Kubernetes infrastructure for SailPoint’s identity security platform. Leading enterprise service mesh adoption, PCI-compliant operations, and cloud-native reliability across global teams.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

Pacvue

501 - 1000

💼 Consultoria

📣 Marketing

📦 Logística

Senior DevOps Engineer building AWS/Kubernetes infrastructure and CI/CD systems for Pacvue’s commerce media platform. Improving reliability, security, observability, and developer productivity across engineering teams.

🗣️🇺🇸🇬🇧 Inglês obrigatório