Director of SRE

🕒 Julho 16

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $190.000 - $220.000 / ano

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

👻 Score fantasma 15%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Blackpoint Cyber

Blackpoint Cyber

51 - 200 funcionários

💼 Consultoria

🎖️ Defesa

🔒 Cibersegurança

💰 $190.000.000 Series C em 2023-06

Consulting • Defense • Cybersecurity

A Blackpoint Cyber é uma empresa de cibersegurança focada em tecnologia, com sede em Maryland, EUA. A empresa foi estabelecida por ex-especialistas em segurança do Departamento de Defesa e Inteligência dos EUA e aproveita sua experiência real em cibernética e conhecimento de técnicas maliciosas para ajudar Provedores de Serviços Gerenciados (MSPs) a proteger sua infraestrutura e operações.\n\nOferecendo o único ecossistema de cibersegurança de classe mundial, com nível de segurança de Estado, a Blackpoint atende à comunidade MSP usando sua própria plataforma proprietária de operações de segurança e resposta a incidentes, o SNAP-Defense, que está disponível como produto ou como um serviço completo de Detecção e Resposta Gerenciada (MDR). A Blackpoint não apenas detecta invasões mais cedo do que qualquer outra solução no mercado, mas seus analistas de segurança dedicados ao MDR trabalham 24/7 para combinar visualização de rede, monitoramento de ameaças internas, antimalware, análise de tráfego e segurança de endpoint em um serviço rapidamente implementado para monitorar e deter ameaças antes que seja tarde demais.\n\nAlém de seus serviços MDR, a Blackpoint está lançando o LogIC, seu novo serviço de registro com conformidade integrada para ajudar os MSPs e seus clientes a atenderem aos requisitos de conformidade de cibersegurança, incluindo avaliações e auditorias. Com configuração simples por meio de botão, a arquitetura de registro hipereficiente do LogIC e o aplicativo web de autoatendimento permitem que você gere relatórios de conformidade e gerencie todos os aspectos da coleta de eventos e logs. Simplifique como você se prepara para auditorias e saiba exatamente onde já está coberto sem comprometer sua postura de segurança.\n\nA Blackpoint Cyber continua trabalhando arduamente para oferecer um ecossistema de cibersegurança eficaz de ponta a ponta para a comunidade MSP. A missão? Fornecer serviços absolutos e unificados de detecção e resposta para MSPs de todos os tamanhos combaterem um cenário de ameaças em constante mudança.\n\nEstamos vencendo a luta desigual. Você está? Saiba mais em www.blackpointcyber.com.

Descrição

• Lead the design, implementation, and management of scalable, reliable, and highly available cloud-based infrastructure (AWS/Azure) • Establish SRE best practices, including monitoring, incident response, capacity planning, and performance tuning • Improve observability, monitoring, and alerting, ensuring quick detection and resolution of reliability issues • Drive automation-first approaches, reducing manual intervention through Infrastructure-as-Code (IaC) and CI/CD pipelines • Lead a team of SREs, applying Blackpoint Cyber's management values of Coach, Model, Care, in defining business-critical outcomes, creating action plans, and supporting the team in achieving them • Continue hands-on contributions in an SRE role • Design, implement, and support key infrastructure, including automated attack infrastructure deployment, isolated identity and productivity environments, and secure data storage • Establish and apply security hygiene and monitoring policies to meet Blackpoint Cyber security requirements • R&D with AI tooling and other SRE tools such as Grafana IRN, Loki, and Alloy • Monitor and optimize cloud spending, ensuring cost-effective resource utilization without compromising reliability • Define and implement cost-saving strategies (e.g., right-sizing instances, leveraging spot instances, optimizing storage, etc.) • Work closely with finance and procurement teams to forecast infrastructure costs and align expenses with business objectives • Manage and mentor a global team of SREs, DevOps engineers, and cloud infrastructure specialists • Partner with engineering teams to design reliable and scalable architectures, embedding reliability into development workflows • Collaborate with security teams to ensure compliance, security hardening, and disaster recovery readiness • Drive post-incident reviews, ensuring continuous improvement in system resilience

🎯 Requisitos

• 10+ years of experience in SRE, DevOps, or Cloud Infrastructure roles • 5+ years of experience in people management, leading SRE team • Strong experience with AWS, Azure, or GCP, with expertise in cost management and scaling strategies • Proficiency in Infrastructure-as-Code (IaC) (e.g., Terraform, CloudFormation, Pulumi) • Hands-on experience with CI/CD pipelines, Kubernetes, and container orchestration • Expertise in monitoring, logging, and observability tools (e.g., Prometheus, Grafana, Datadog, Splunk) • Proven ability to optimize cloud costs (COGS) while maintaining reliability and performance • Strong leadership, collaboration, and problem-solving skills • Experience with SLA/SLO/SLIs will be valuable • A general understanding of the modern AI tooling landscape and how SRE can use that to increase velocity and improve stability

🏖️ Benefícios

• Health, Vision, Dental, and Life Insurance plans • Competitive 401k plan • Discretionary Time Off • Other minor perks

Candidatar-se

Vagas Similares

🕒 Julho 15

RTX

10.000+ funcionários

🏭 Manufatura

💼 Consultoria

📦 Logística

Site Reliability Engineer automating and improving reliability of ARINCDirect infrastructure at Collins Aerospace. Collaborating across teams for dependable and scalable solutions.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $107.500 - $204.500 / ano

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 6

Vytalize Health

201 - 500

🏥 Saúde

☁️ SaaS

⚕️ Seguro de Saúde

DevSecOps Engineer responsible for implementing secure development and cloud security practices. Leading vulnerability management and integrating security within engineering and IT workflows.

🇺🇸 Estados Unidos – Remoto (EUA)

💰 $100.000.000 Series C - Vytalize Health em 2023-02

⏰ Tempo Integral

🟠 Sênior

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 6

HubSpot

1001 - 5000

🤝 B2B

☁️ SaaS

📣 Marketing

Principal Software Engineer at HubSpot shaping future release engineering with large-scale systems and AI integration. Focused on deployment pipelines, build infrastructure, and innovative software delivery.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Junho 30

Assured

11 - 50

🛡️ Seguros

☁️ SaaS

🤖 Inteligência Artificial

Staff Site Reliability Engineer optimizing database systems for tech-driven insurance provider. Leading design, automation, and performance initiatives for a modern claims processing platform.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Junho 23

AlphaSense

1001 - 5000

💼 Consultoria

🏥 Saúde

📣 Marketing

Staff SRE architecting reliability platforms for AlphaSense’s AI-powered market intelligence platform. Leading AIOps, incident response, observability, and SRE culture across global engineering.

🇺🇸 Estados Unidos – Remoto (EUA)

💵 $150.000 - $225.000 / ano

💰 Debt Financing em 2022-06

⏰ Tempo Integral

🔴 Especialista

⛑ DevOps & Engenheiro de Confiabilidade do Site (SRE)

🦅 Patrocina Visto H1B

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório