Senior AI Tools Engineer, SRE Operations

Vaga não está no LinkedIn

🕒 6 dias atrás

🏄 California – Remoto

info

💵 $144.000 - $230.000 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of NVIDIA

NVIDIA

10.000+ funcionários

Fundada em 1993

🏥 Saúde

🏭 Manufatura

🤖 Inteligência Artificial

Healthcare • Manufacturing • Artificial Intelligence

A NVIDIA é uma empresa de tecnologia líder, especializada em computação acelerada e inteligência artificial. A companhia é pioneira em avanços em unidades de processamento gráfico (GPUs), computação em nuvem, data centers e realidade virtual, com foco nos setores de games, automotivo, saúde e robótica. As inovações da empresa, como o NVIDIA Omniverse, transformam processos digitais tradicionais ao viabilizar simulações de alta fidelidade e tarefas de renderização. Suas aplicações abrangem diversos setores, desde veículos autônomos com o NVIDIA DRIVE até soluções de saúde com o NVIDIA Clara, além de análises e fluxos de trabalho impulsionados por IA.

Descrição

• Build and deploy sophisticated AI-powered tools and products supporting operation and optimization of the global GeForce NOW service • Transform production data streams, including signals, metrics, and logs, into actionable intelligence • Automate root cause analysis for incidents and predict future service trends and patterns • Build and implement AI/ML tools to identify incident root causes and operational trends • Lead development of LLM- and agent-based systems to improve operational efficiency • Establish and maintain data management practices and pipelines for large-scale model-development data • Own and enhance LLM-based pipelines • Integrate knowledge of LLM progress into product development • Serve as an authority on AI frameworks and recommend platforms, toolsets, and architectures for long-term product sustainability

🎯 Requisitos

• B.S. in Computer Science, Statistics, or Engineering, or equivalent experience • 5+ years of experience • Strong proficiency in Python • Familiarity with Go or other systems languages is a plus • Practical experience building, optimizing, and deploying AI tools • Strong knowledge of AI developments and LLM-based platforms • Hands-on experience with Kubernetes and AWS cloud environments • Ability to distinguish meaningful AI advances from noise in technical decisions • Expertise in automation and large-scale data pipelines • Experience with monitoring and visualization tools such as Grafana • Excellent ability to handle, transform, and manage data sources and pipelines • Understanding of SRE principles and production-environment management is preferred • Experience with LLM improvement pipelines and recent LLM training developments is preferred • Knowledge of LLMs and AI models, including ability to recommend sustainable platforms and approaches

🏖️ Benefícios

• Equity • Benefits • Competitive salary package • Inclusive and supportive work environment

Candidatar-se

Vagas Similares

🕒 6 dias atrás

SitusAMC

5001 - 10000

💼 Consultoria

📦 Logística

🏠 Imobiliário

Site Reliability Engineer operating AWS cloud infrastructure for SitusAMC’s real estate technology solutions. Improving reliability, automation, observability, security, and application migrations.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $95.000 - $135.000 / ano

💰 Private equity em 2020-05

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

info

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

GE Vernova

10.000+ funcionários

💼 Consultoria

📦 Logística

🏭 Manufatura

Senior Reliability Engineer improving embedded protection, control, and software products for GE Vernova’s decarbonization mission. Driving testing, field analytics, grid reliability, and cybersecurity compliance.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $162.900 - $244.300 / ano

⏰ Tempo Integral

🟠 Sênior

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

SailPoint

1001 - 5000

💼 Consultoria

🏥 Saúde

📦 Logística

Senior Staff DevOps Engineer scaling AWS Kubernetes infrastructure for SailPoint’s identity security platform. Leading enterprise service mesh adoption, PCI-compliant operations, and cloud-native reliability across global teams.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

Pacvue

501 - 1000

💼 Consultoria

📣 Marketing

📦 Logística

Senior DevOps Engineer building AWS/Kubernetes infrastructure and CI/CD systems for Pacvue’s commerce media platform. Improving reliability, security, observability, and developer productivity across engineering teams.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

Merchants Fleet

201 - 500

📦 Logística

💼 Consultoria

🚘 Automotivo

DevOps Manager scaling Azure cloud delivery for Merchants Fleet, a North American fleet management company. Leading engineers, modernization, automation, and secure infrastructure.

🗣️🇺🇸🇬🇧 Inglês obrigatório