Senior Cloud Monitoring and Observability Engineer

🕒 2 dias atrás

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $107.900 - $195.050 / ano

⏰ Tempo Integral

🟠 Sênior

👷🏻‍♀️ Engenheiro

🦅 Patrocina Visto H1B

infoinfo

👻 Score fantasma 10%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Leidos

Leidos

10.000+ funcionários

Fundada em 1969

🏥 Saúde

💼 Consultoria

📦 Logística

Healthcare • Consulting • Logistics

A Leidos é uma integradora líder em ciência, tecnologia e engenharia, fornecendo soluções que transformam e viabilizam as missões de seus clientes. A empresa atua em diversos mercados, incluindo aviação, defesa, energia, governo, saúde, inteligência, ciência e espaço. A Leidos está envolvida em IA, modernização digital, operações cibernéticas e sistemas de software integrados e de missão. Com um compromisso com diversidade, equidade, inclusão e sustentabilidade, a Leidos também se engaja em esforços beneficentes e programas de enriquecimento comunitário. Além disso, contribui para o desenvolvimento de soluções para sistemas contra veículos aéreos não tripulados e infraestrutura de veículos elétricos para aplicações militares.

Descrição

• Engineer, operate, maintain, and continuously improve the enterprise monitoring and observability platform • Assess monitoring coverage, identify visibility gaps, and coordinate onboarding or remediation • Maintain monitoring coverage across Windows, Linux, cloud, OpenShift/Kubernetes, virtualized, database, network, storage, middleware, and application environments • Support monitoring for Red Hat OpenShift, Kubernetes, OpenShift Virtualization, and virtual machine workloads • Configure and troubleshoot monitoring agents, integrations, collectors, APIs, and platform components • Build and maintain tagging, metadata, dashboards, alerts, service health views, and operational reporting • Automate monitoring deployment, configuration, tagging, onboarding, upgrades, and integrations • Develop and maintain integrations with ServiceNow, notification systems, on-call workflows, and enterprise operational systems • Troubleshoot performance and availability issues, support incident response and root-cause analysis, and recommend remediation • Correlate infrastructure, application, platform, and dependency telemetry to identify service degradation and recurring issues • Partner with Operations and engineering teams to improve coverage, alert quality, visibility, incident detection, escalation, and response • Analyze telemetry and historical trends to identify capacity risks, recurring issues, monitoring gaps, and improvement opportunities • Develop performance, availability, capacity, and monitoring coverage reporting for technical and leadership stakeholders • Maintain monitoring standards, technical documentation, configuration guidance, and operational procedures

🎯 Requisitos

• BS degree and 8-12 years of prior relevant experience, or Master's degree with 6-10 years of prior relevant experience • Additional relevant experience may be considered in lieu of degree requirements where permitted by contract • Strong hands-on experience engineering and operating enterprise monitoring or observability platforms • Strong Datadog experience preferred; substantial experience with ScienceLogic SL1, SolarWinds, Dynatrace, New Relic, Splunk Observability, LogicMonitor, Prometheus/Grafana, or comparable enterprise platforms considered • Ability to apply monitoring and observability engineering principles across technologies and rapidly develop proficiency with new platforms • Production experience monitoring Windows and Linux infrastructure and Kubernetes or Red Hat OpenShift environments • Experience deploying, configuring, upgrading, and troubleshooting monitoring agents, integrations, dashboards, alerts, tagging, and operational reporting • Experience automating monitoring deployment or administration using Ansible, APIs, scripting, CI/CD pipelines, infrastructure-as-code, or similar technologies • Experience integrating monitoring or observability platforms with ITSM systems such as ServiceNow • Strong troubleshooting and dependency-analysis skills across infrastructure, applications, networks, platforms, and services • Ability to analyze technical telemetry, identify monitoring or performance gaps, and translate findings into actionable recommendations • Ability to communicate technical findings and recommendations to technical teams, project leadership, and customer stakeholders • Must meet applicable contract citizenship and work authorization requirements and be able to obtain and maintain SEC Public Trust or other required clearance • Preferred: application performance monitoring, distributed tracing, OpenTelemetry, Datadog APM, Log Management, Synthetic Monitoring, RUM, Network Performance Monitoring, Database Monitoring • Preferred: Red Hat OpenShift Virtualization, CNV, KubeVirt, Azure or AWS, Terraform, monitoring-as-code, API-driven deployment, FISMA, FedRAMP, NIST, or related security requirements • Relevant technical certifications such as Datadog, AWS, Microsoft Azure, Red Hat OpenShift, Terraform, or ITIL preferred

Candidatar-se

Vagas Similares

🕒 2 dias atrás

AeroVect

11 - 50

📦 Logística

💼 Consultoria

🚀 Aeroespacial

Senior Software Safety Engineer advancing safety for AeroVect’s autonomous ground-handling platforms. Performing ISO 26262 analyses, deriving requirements, and supporting airport deployment.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $160.000 - $180.000 / ano

💰 Seed Round em 2022-07

⏰ Tempo Integral

🟠 Sênior

👷🏻‍♀️ Engenheiro

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 2 dias atrás

Sargent & Lundy

1001 - 5000

🏗️ Construção

🎖️ Defesa

⚡ Energia

Lead I&C engineer modernizing nuclear power plants with digital control technologies. Managing multidisciplinary projects, nuclear control-system design, vendors, and client execution.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $118.023 - $180.313 / ano

⏰ Tempo Integral

🟠 Sênior

👷🏻‍♀️ Engenheiro

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 2 dias atrás

1mind

11 - 50

🤖 Inteligência Artificial

☁️ SaaS

🤝 B2B

Prompt and context engineer designing LLM subagents and agentic workflows. Building 1mind’s autonomous customer-experience platform for next-generation revenue teams.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $100.000 - $150.000 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

👷🏻‍♀️ Engenheiro

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 2 dias atrás

Instacart

1001 - 5000

🍽️ Alimentos e Bebidas

📦 Logística

🛍️ Comércio Eletrônico

Senior Detection Engineer building threat detections for Instacart’s grocery delivery platform. Automating response and investigating adversary activity across cloud, endpoint, container, and SaaS environments.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $192.000 - $242.500 / ano

💰 $232.000.000 Venture Round em 2021-11

⏰ Tempo Integral

🟠 Sênior

👷🏻‍♀️ Engenheiro

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 2 dias atrás

Ulteig

1001 - 5000

💼 Consultoria

📦 Logística

🏗️ Construção

Transmission Line Engineer designing 69kV–500kV transmission lines for Ulteig, an engineering firm transforming North America’s critical infrastructure. Developing construction documents and coordinating multidisciplinary projects.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $104.800 - $141.900 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

👷🏻‍♀️ Engenheiro

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Assembly