
11 - 50 funcionários
🤖 Inteligência Artificial
Artificial Intelligence • Cloud Computing
A FluidStack é uma empresa que fornece infraestrutura de supercomputação com GPUs para laboratórios de IA. Ela oferece acesso sob demanda a milhares de GPUs Nvidia, permitindo treinamento e inferência de IA em larga escala. A empresa se especializa em implantar e gerenciar grandes clusters de GPUs, com suporte para tecnologias como Kubernetes e Slurm, garantindo alta disponibilidade e excelente suporte. A FluidStack fornece uma infraestrutura de nuvem totalmente gerenciada, ajudando empresas de IA a focarem no desenvolvimento de modelos sem se preocuparem com o hardware subjacente. Eles enfatizam desempenho e eficiência de custos, oferecendo serviços que escalam para milhares de GPUs com alta disponibilidade e tempos de resposta rápidos.
🕒 4 dias atrás
🇺🇸 Estados Unidos – Remoto (EUA)
💵 $220.000 - $260.000 / ano
⏰ Tempo Integral
🔴 Especialista
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇺🇸🇬🇧 Inglês obrigatório
Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

11 - 50 funcionários
🤖 Inteligência Artificial
Artificial Intelligence • Cloud Computing
A FluidStack é uma empresa que fornece infraestrutura de supercomputação com GPUs para laboratórios de IA. Ela oferece acesso sob demanda a milhares de GPUs Nvidia, permitindo treinamento e inferência de IA em larga escala. A empresa se especializa em implantar e gerenciar grandes clusters de GPUs, com suporte para tecnologias como Kubernetes e Slurm, garantindo alta disponibilidade e excelente suporte. A FluidStack fornece uma infraestrutura de nuvem totalmente gerenciada, ajudando empresas de IA a focarem no desenvolvimento de modelos sem se preocuparem com o hardware subjacente. Eles enfatizam desempenho e eficiência de custos, oferecendo serviços que escalam para milhares de GPUs com alta disponibilidade e tempos de resposta rápidos.
• Own fleet reliability engineering: define availability targets, measure them honestly, and close the gap. • Run root cause analysis on the fleet's worst incidents and drive corrective actions to done across every site. • Build the failure data pipeline, facility and hardware both, that turns incident history into engineering priorities. • Set the maintenance strategy (reliability-centered, condition-based) so the fleet spends effort where the failure data says to.
• You've owned reliability for critical infrastructure and moved the availability number, not just reported it. • You've led root cause analyses that found the real cause, not the convenient one. • You work fluently with failure data: Weibull, Pareto, and FMEA are tools you actually use, not terms you know. • You get corrective actions closed across teams you don't manage. • Bonus: Data center or power generation reliability. Liquid cooling systems. CMMS analytics. CRE or CMRP certification.
• base salary • equity for all full time roles • benefits • commissions plans if applicable
Candidatar-se🕒 4 dias atrás
Head of Forward Deployed Engineering at Tavily, managing strategic customer engagements and leading a growing engineering team. Overseeing technical strategy for enterprise accounts across product and engineering teams.
🇺🇸 Estados Unidos – Remoto (EUA)
💵 $230.000 - $310.000 / ano
🔥 Investimento no último ano
💰 $20.000.000 Series A - Tavily em 2025-08
⏰ Tempo Integral
🔴 Especialista
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 4 dias atrás
Staff DevOps Engineer responsible for the cloud infrastructure powering care delivery for over 100,000 patients. Cadence Solutions automates chronic disease care with clinical AI technology.
🇺🇸 Estados Unidos – Remoto (EUA)
💵 $200.000 - $260.000 / ano
⏰ Tempo Integral
🔴 Especialista
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 4 dias atrás
Director of Site Reliability Engineering at Counterpart Health managing a team of SREs and enhancing infrastructure reliability. Leading strategic initiatives across multiple regions and supporting healthcare innovation.
🇺🇸 Estados Unidos – Remoto (EUA)
💵 $187.000 - $243.000 / ano
⏰ Tempo Integral
🔴 Especialista
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 4 dias atrás
Staff Site Reliability Engineer leading Finalsite's infrastructure evolution and operational excellence practices. Collaborating with engineering leadership to enhance CI/CD and multi-cloud reliability.
🇺🇸 Estados Unidos – Remoto (EUA)
💵 $180.000 - $250.000 / ano
💰 Debt financing em 2014-12
⏰ Tempo Integral
🔴 Especialista
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 4 dias atrás
Senior DevSecOps Engineer enhancing cybersecurity compliance for federal standards and DoD authorization processes. Leading secure CI/CD implementations and DevSecOps toolchain management for government projects.
🇺🇸 Estados Unidos – Remoto (EUA)
⏰ Tempo Integral
🟠 Sênior
🔴 Especialista
⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)
🗣️🇺🇸🇬🇧 Inglês obrigatório