Staff Site Reliability Engineer, Core AI Infrastructure

🕒 Junho 9

🏄 California – Remoto

infoinfo

💵 $218.025 - $256.500 / ano

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

👻 Score fantasma 19%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Coinbase

Coinbase

1001 - 5000 funcionários

Fundada em 2012

💼 Consultoria

₿ Cripto

💸 Finanças

💰 $21.400.000 Post-IPO Equity em 2022-11

Consulting • Crypto • Finance

A Coinbase é uma exchange de criptomoedas líder que permite que pessoas físicas e instituições comprem, vendam e negociem diversos criptoativos, como Bitcoin e Ethereum. A empresa oferece ferramentas avançadas de trading, soluções institucionais e uma carteira de autocustódia para armazenar e gerenciar criptomoedas. Com forte foco em segurança e transparência, a Coinbase disponibiliza uma plataforma confiável usada por milhões de pessoas no mundo todo. Ela oferece diversos recursos, incluindo staking, ganhos de recompensas e a possibilidade de gastar cripto por meio de seus cartões. Além disso, a Coinbase fornece ferramentas para desenvolvedores e APIs para construir aplicações onchain, tornando-se um hub completo para participar da economia cripto.

Descrição

• Own the reliability, monitoring, and incident response lifecycle for AI infrastructure services, including on-call support for AWS deployment pipelines, root cause analysis, and blameless retros. • Build automation and tooling to streamline operational IT workflows, eliminate manual tasks, and improve deployment velocity across CI/CD frameworks and Kubernetes environments. • Partner with the Coinbase Infrastructure team to extend CI/CD frameworks supporting IT services and enterprise network platforms, and with Security and Compliance to integrate surveillance tooling into deployment pipelines. • Strengthen observability and documentation standards across IT engineering by defining metrics, implementing monitoring solutions, and maintaining technical documentation that sets a standard of excellence. • Develop full-stack applications that power internal AI products and infrastructure with Go or Python.

🎯 Requisitos

• 8+ years of experience automating and supporting cloud infrastructure (AWS) and network environments, with hands-on use of infrastructure-as-code tools (Terraform, Ansible, Chef, Puppet, or Salt). • Proven experience deploying, managing, and troubleshooting containerized workloads using Docker and Kubernetes in production environments. • Proficiency in at least one scripting or programming language (Python, Bash, Ruby, or Go) and version control workflows using Git-based CI/CD pipelines. • Track record of leading incident response in environments with strict SLAs, including root cause analysis, blameless retros, and measurable reliability improvements. • Utilizes generative AI responsibly, maintaining human oversight to deliver business-ready outputs and drive measurable improvements in workflow efficiency, cost, and quality.

🏖️ Benefícios

• medical • dental • vision • 401(k)

Candidatar-se

Vagas Similares

🕒 Maio 29

Capgemini

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Mainframe DevOps Migration Consultant at Capgemini Engineering supporting application migration projects utilizing client’s DBB/Git/IDD Solutions.

🗣️🇺🇸🇬🇧 Inglês obrigatório

Groovy

🕒 Maio 29

Capgemini

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Software Change Management Consultant supporting application migration projects utilizing IBM DBB/Git/IDD solutions. Leading technical training and troubleshooting in a remote capacity across North America.

🗣️🇺🇸🇬🇧 Inglês obrigatório

Groovy

🕒 Maio 27

Titan AI

1 - 10

🎮 Jogos

🥽 AR/VR

🤖 Inteligência Artificial

VP of Site Reliability managing SRE and operational functions for banking AI software company. Leading engineering practices and ensuring reliable platform deployment for financial institutions.

🇺🇸 Estados Unidos – Remoto (EUA)

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Maio 20

Crusoe

51 - 200

💼 Consultoria

🏭 Manufatura

📦 Logística

Staff Instrumentation & Controls Engineer for Crusoe, focusing on deployment of automation solutions in hyperscale data centers. Overseeing complex projects, ensuring seamless integrations, and driving efficiencies.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $148.000 - $170.000 / ano

💰 $155.000.000 Debt Financing em 2022-04

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Maio 18

Valiantys - Atlassian Platinum Solution Partner

51 - 200

💼 Consultoria

📣 Marketing

📦 Logística

Director for AI-Enabled DevOps Transformation at Valiantys, focusing on enterprise account growth and strategy alignment. Engage with clients on SDLC modernization and AI-enabled delivery.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $175.000 - $240.000 / ano

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório