Observability Technical Lead

🕒 6 dias atrás

🐊 Florida – Remoto

infoinfo

💵 $96.000 - $192.000 / ano

⏰ Tempo Integral

🟠 Sênior

🧑‍💻 Engenheiro Full-stack

🦅 Patrocina Visto H1B

infoinfo

👻 Score fantasma 0%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Carrier

Carrier

10.000+ funcionários

Fundada em 1915

🏗️ Construção

🏥 Saúde

📦 Logística

Construction • Healthcare • Logistics

A Carrier é uma líder global em soluções de construção e cadeia de frio, dedicada à inovação na criação de ambientes saudáveis, seguros, sustentáveis e inteligentes. A empresa atua nos sistemas de HVAC e refrigeração, focando na promoção da saúde e segurança de ambientes internos e na preservação do fornecimento global de alimentos e medicamentos através de suas tecnologias avançadas. A Carrier também está comprometida em enfrentar as mudanças climáticas e colabora com parceiros para impulsionar a sustentabilidade e eficiência energética em infraestrutura. Ao explorar soluções de construção inteligente e resiliência energética, a Carrier está avançando em direção a um futuro de emissões zero.

Descrição

• Serve as the senior SME for enterprise observability and define architectures, standards, integration patterns, and reusable solutions • Design and optimize observability across cloud, on-premises infrastructure, networks, Kubernetes, containers, applications, APIs, databases, middleware, and enterprise platforms • Standardize metrics, logs, traces, events, topology, dashboards, alerting, instrumentation, and service health • Provide technical leadership for LogicMonitor, Splunk, OpenTelemetry, Grafana, Prometheus, Tempo, VictoriaMetrics, Loki, and related technologies • Lead OpenTelemetry adoption, including instrumentation, collectors, telemetry pipelines, distributed tracing, context propagation, and vendor-neutral standards • Design telemetry pipelines routing metrics, logs, and traces across multiple platforms • Develop API-driven and Observability-as-Code capabilities for onboarding, configuration, validation, and lifecycle management • Establish governance for RBAC, telemetry standards, alerting, retention, integrations, configuration management, and data lifecycle • Improve observability coverage, telemetry quality, scalability, reliability, performance, and cost efficiency • Drive automation and self-service through APIs, Infrastructure-as-Code, CI/CD, GitOps, and reusable observability patterns • Integrate Edwin AI and AIOps capabilities for anomaly detection, event correlation, root-cause analysis, investigation, and operational intelligence • Connect telemetry and operational context to deliver end-to-end visibility • Establish reliability standards including SLIs, SLOs, error budgets, monitoring coverage, alert quality, MTTD, and MTTR • Reduce alert fatigue through intelligent correlation, dynamic thresholds, suppression, automation, and event-management practices • Evaluate eBPF, continuous profiling, Kubernetes observability, dependency mapping, and auto-instrumentation • Advance operations from reactive monitoring toward proactive and predictive operations • Collaborate with engineering and operations teams across North America, Europe, and Asia • Lead architecture reviews, platform evaluations, workshops, and technical working sessions • Influence observability strategy and standards across teams without direct authority • Mentor engineers and promote observability, SRE, and reliability best practices • Evaluate emerging technologies and recommend adoption based on interoperability, scalability, business value, and cost • Translate strategy into standards, reference architectures, and reusable implementation patterns

🎯 Requisitos

• Bachelor’s Degree • 7+ years of experience in observability, monitoring, APM, SRE, DevOps, platform engineering, or related professional experience • 7+ years of experience designing, implementing, operating, and maintaining enterprise-scale observability platforms using observability-as-code, monitoring-as-code, infrastructure-as-code, GitOps, and CI/CD practice • Experience with AWS, Azure, GCP, and large-scale Kubernetes environments • Experience designing OpenTelemetry Collector architectures and telemetry pipelines • Expertise with Grafana, Tempo, Loki, and Prometheus-compatible platforms • Experience with VictoriaMetrics or other large-scale time-series databases • Knowledge of eBPF, continuous profiling, auto-instrumentation, and cloud-native telemetry • Experience integrating observability platforms with ServiceNow, ITSM, CMDB, incident management, and automation platforms • Understanding of SRE practices including SLIs, SLOs, error budgets, and incident management • Experience enabling developer self-service and internal developer platform integrations • Knowledge of RBAC, secrets management, governance, compliance, and telemetry data protection • Reasonable schedule flexibility to support global collaboration

🏖️ Benefícios

• Short-term cash incentives, subject to plan requirements • Medical, Dental, and Vision benefits • Wellness incentives • Retirement benefits • Paid vacation days, up to 15 days • Paid sick days, up to 5 days • Paid personal leave, up to 5 days • Paid holidays, up to 13 days • Birth and adoption leave • Parental leave • Family and medical leave • Bereavement leave • Jury duty leave • Military leave • Purchased vacation • Short-term and long-term disability • Life Insurance and Accidental Death and Dismemberment • Health Savings Account • Health Care Spending Account • Dependent Care Spending Account • Tuition Assistance

Candidatar-se

Vagas Similares

🕒 6 dias atrás

Togal.AI

11 - 50

🏗️ Construção

💼 Consultoria

🤖 Inteligência Artificial

GTM Engineer owning predictive models, campaign infrastructure, and AI personalization. Building revenue systems for an AI-powered construction pre-estimating platform.

🇺🇸 Estados Unidos – Remoto (EUA)

💰 $7.000.000 Seed Round - Togal.AI em 2023-03

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🧑‍💻 Engenheiro Full-stack

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

PrizePicks

201 - 500

🎮 Jogos

⚽ Esportes

Software Engineer III building scalable Ruby on Rails services for PrizePicks’ daily fantasy sports platform. Owning rewards and loyalty features, architecture, code quality, and junior engineer guidance.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $145.000 - $165.000 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🧑‍💻 Engenheiro Full-stack

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

GE Vernova

10.000+ funcionários

💼 Consultoria

📦 Logística

🏭 Manufatura

Technical Leader designing SCADA, cybersecurity, and grid automation solutions for GE Vernova’s energy-sector customers. Leading projects from presales and technical design through testing, commissioning, and customer training.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $98.400 - $164.000 / ano

⏰ Tempo Integral

🟠 Sênior

🧑‍💻 Engenheiro Full-stack

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 6 dias atrás

LouisianaNOW.Jobs

51 - 200

🎯 Recrutamento

🏪 Marketplace

Databricks Data Engineer building Azure pipelines for CGI’s credit-card modernization projects. Transforming financial data with PySpark, Databricks, and reconciliation controls.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $79.600 - $156.700 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🧑‍💻 Engenheiro Full-stack

🗣️🇺🇸🇬🇧 Inglês obrigatório

Azure

ETL

Informatica

PySpark

Python

Spark

SQL

SSIS

Unity

🕒 6 dias atrás

Vontier

5001 - 10000

🚘 Automotivo

⚡ Energia

🔧 Hardware

Software Engineer II developing automated tank gauge and fueling infrastructure software for Gilbarco Veeder-Root. Designing solutions, applying modern technologies, improving Agile practices, and mentoring engineers.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $96.800 - $120.000 / ano

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🧑‍💻 Engenheiro Full-stack

🗣️🇺🇸🇬🇧 Inglês obrigatório