Site Reliability Engineer – Low-Latency Trading Systems

Vaga não está no LinkedIn

🕒 Setembro 18

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

👻 Score fantasma 13%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Ondo Finance

Ondo Finance

51 - 200 funcionários

₿ Cripto

💳 Fintech

💸 Finanças

💰 Initial Coin Offering - Ondo Finance em 2024-01

Crypto • Fintech • Finance

A Ondo é uma empresa que desenvolve infraestruturas e produtos financeiros onchain de nível institucional que conectam finanças tradicionais (TradFi) e finanças descentralizadas (DeFi). Seus produtos incluem valores mobiliários públicos tokenizados (Ondo Stocks) que tornam valores públicos livremente transferíveis e utilizáveis em DeFi, USDY (uma stablecoin de retorno sem permissão) e OUSG (um produto institucional que oferece exposição a Treasuries dos EUA de curto prazo com tokenização e resgates instantâneos 24/7). A Ondo enfatiza conformidade, segurança de nível institucional, auditorias de terceiros e parcerias com gestores de ativos e prestadores de serviços regulados. A tecnologia Nexus da empresa permite a tokenização instantânea e o resgate de Treasuries dos EUA e stablecoins, e suporta emissão e distribuição omnichain. A Ondo trabalha com parceiros como Broadridge, J. P. Morgan, Mastercard, Ripple e gestores de ativos para trazer capacidades de votação e resgate transfronteiriço para ativos tokenizados.

Descrição

• Own production reliability for real-time trading services, including trading engines, execution gateways, market data ingestion, and PnL/reconciliation pipelines • Operate and evolve multi-region Kubernetes clusters on AWS EKS using GitOps with Flux and SOPS-encrypted secrets • Build and refine Prometheus metrics and alerting, Datadog logs and dashboards, and SLOs • Improve deployment safety through progressive rollouts, configuration reload behavior, and safeguards for live trading • Debug production incidents involving stale market data, exchange rate limits, WebSocket disconnects, order-lifecycle desynchronization, and trading-path latency regressions • Harden market data ingestion from Databento and venue-native REST/WebSocket feeds through staleness detection, failover, and replay • Build reconciliation and data-integrity tooling across live gauges, Postgres, and S3 Parquet data lake • Participate in on-call rotation covering US equity market hours and 24/7 crypto venues

🎯 Requisitos

• 5+ years in SRE, production engineering, or infrastructure roles, with meaningful time supporting real-time or latency-sensitive systems • Strong programming ability in Go or Rust, and willingness to work in both • Deep, hands-on Kubernetes and AWS experience running stateful, latency-sensitive workloads in production • Fluent PromQL, structured-log analysis, and experience designing high-signal, low-noise alerts • Solid Linux internals and networking fundamentals • Ability to chase p99 regressions through the kernel, NIC, or GC • Experience participating in incident response and communicating clearly during and after incidents • Must be based in the United States

🏖️ Benefícios

• Competitive compensation including future token rights and/or equity according to preferences • Full medical, vision, and dental benefits • Flexible vacation policy (PTO) • Remote-first work arrangement • Opportunity to help shape the company’s vision, culture, and design practices • Collaboration with A+ colleagues and leading industry experts

Candidatar-se

Vagas Similares

🕒 Setembro 18

Gifthealth

501 - 1000

🏥 Saúde

📦 Logística

💼 Consultoria

DevSecOps Engineer embedding automated security across Gifthealth’s prescription healthcare platform. Building CI/CD, application, infrastructure, container, and Kubernetes security controls.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $115.000 - $165.000 / ano

💰 $40.000.000 Private Equity Round - GiftHealth em 2023-04

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 18

Replit

51 - 200

🤖 Inteligência Artificial

🤝 B2B

Senior Site Reliability Engineer ensuring Replit’s reliable, scalable infrastructure serving millions of developers. Automating operations, observability, incident response, and performance optimization.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 18

TherapyNotes, LLC

51 - 200

💼 Consultoria

⚖️ Jurídico

🏥 Saúde

Site Reliability Engineer improving reliability, observability, and incident response for TherapyNotes’ behavioral health practice-management and EHR SaaS platform. Designing resilient cloud infrastructure for 24×7 production services.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $110.000 - $150.000 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 17

Sphera

1001 - 5000

💼 Consultoria

🏥 Saúde

📦 Logística

Cybersecurity Engineer securing Sphera’s environmental, health, safety, and sustainability software for U.S. government and DoD clients. Managing RMF, STIG, ATO, vulnerability remediation, and DevSecOps compliance.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Setembro 17

Arista Networks

1001 - 5000

🏢 Corporativo

📡 Telecomunicações

FedRAMP SRE operating Arista Networks’ Kubernetes-native CloudVision networking SaaS. Ensuring reliable, secure, scalable production systems and leading infrastructure projects.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $101.000 - $161.000 / ano

💰 $2.600.000 Post-IPO Debt em 2015-05

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório