Engenheiro de Dados Sênior Databricks/DBT

Vaga não está no LinkedIn

🔥 12 horas atrás

🇧🇷 Brasil – Remoto

⏰ Tempo Integral

🟠 Sênior

🚰 Engenheiro de Dados

👻 Score fantasma 14%

infoinfo

🗣️🇧🇷🇵🇹 Português obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Leega

Leega

201 - 500 funcionários

Fundada em 2010

💼 Consultoria

📣 Marketing

🔌 API

Consulting • Marketing • API

A Leega é uma provedora líder de soluções de tecnologia na América Latina, especializada em analytics de dados e soluções em nuvem. Primeira empresa na região certificada pelo Google Cloud em Data Analytics, a Leega oferece um portfólio de serviços que inclui desenvolvimento de aplicações, machine learning e analytics para gestão de riscos. A empresa faz parcerias com os principais provedores de nuvem, como AWS e Microsoft Azure, para ajudar as empresas a aprimorar a gestão de dados e realizar uma migração eficiente para a nuvem, impulsionando a transformação digital e a inovação.

Descrição

• Construir e evoluir a nova plataforma de dados da empresa, baseada em DBT sobre Databricks • Projetar e implementar a arquitetura da plataforma dbt sobre Databricks, incluindo Unity Catalog e camadas medallion (bronze/silver/gold) • Estruturar o projeto DBT com padrões de modelagem, naming, camadas, macros, testes e documentação • Aplicar modelagem dimensional (Kimball, star schema) e/ou Data Vault conforme a necessidade • Construir pipelines de CI/CD para DBT via GitHub Actions, incluindo validação, build, testes e deploy em dev/staging/prod • Automatizar provisionamento e operação via IaC (Terraform) e Databricks Asset Bundles • Desenvolver e manter Workflows no Databricks para orquestração de pipelines • Gerenciar ambientes reproduzíveis com versionamento de código usando Git, GitFlow ou trunk-based • Otimizar custo e performance de clusters, SQL Warehouses, Photon, particionamento e modelos incrementais • Trabalhar com Delta Lake, Parquet e formatos de dados distribuídos • Explorar Apache Spark e PySpark para casos além do SQL quando necessário • Definir governança e segurança de dados, incluindo Unity Catalog, controle de acesso e masking de dados sensíveis • Garantir compliance com LGPD e boas práticas de privacidade de dados • Mentorar o time em boas práticas de engenharia analítica • Revisar código (PRs) e garantir a qualidade técnica das entregas • Atuar em ambientes ágeis e colaborativos

🎯 Requisitos

• DBT Core: modelos incrementais, snapshots, macros (Jinja), testes, packages, exposures — mín. 4 anos • Databricks: Unity Catalog, SQL Warehouses, clusters, Delta Lake, Workflows — mín. 4 anos • Apache Spark e processamento distribuído de dados • Python e SQL avançado • GitHub Actions para CI/CD de pipelines de dados • Databricks Asset Bundles para empacotamento e deploy • Git e fluxo colaborativo (trunk-based ou GitFlow, PRs, code review) • Cloud computing — preferencialmente GCP (Azure ou AWS também aceitos) • Ferramentas de ETL/ELT e integração de dados • Cultura de testes automatizados, versionamento e deploy reproduzível • dbt Fusion / migração para dbt Core 2.0 — diferencial • Terraform e IaC para gerenciamento de ambientes e secrets — diferencial • Orquestração com Airflow ou Dagster — desejável • Kubernetes e containers (Docker) — desejável • Observabilidade de dados: dbt docs, Elementary, Monte Carlo, OpenLineage — desejável • Experiência com mascaramento de dados sensíveis / LGPD e compliance — desejável • Modelagem dimensional Kimball / star schema / Data Vault — desejável

🏖️ Benefícios

• Convênio Médico Porto Seguro, com possibilidade de incluir cônjuge e filhos • Convênio Odontológico Porto Seguro para colaboradores e dependentes • Participação nos Lucros e Resultados (PLR) • Auxílio Creche • Vale Alimentação e Refeição Alelo • Auxílio Home Office • Parcerias com Instituições de Ensino, com descontos e incentivos em cursos e graduações • Incentivo para Certificações, inclusive em Cloud (GCP, Azure, AWS, entre outras) • Pontos Livelo • TotalPass, com planos de academia com desconto para colaboradores e familiares • Mindself, com incentivo à meditação e ao Mindfulness • Trabalho 100% remoto • Capacitação constante

Candidatar-se

Vagas Similares

🔥 12 horas atrás

Experian

10.000+ funcionários

💼 Consultoria

📣 Marketing

📦 Logística

Engenheiro(a) Líder de Dados responsável por evoluir a plataforma de dados AWS da Experian em escala de petabytes. Construção de pipelines e serviços escaláveis para soluções de marketing orientadas por dados de próxima geração.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Ontem

Stefanini Brasil

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Engenheiro(a) de Dados Especialista apoiando a exploração, limpeza e análise de dados na Stefanini. Construção de pipelines em Python/PySpark e dashboards para apoiar decisões orientadas por dados.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Ontem

Compass

10.000+ funcionários

🏠 Imobiliário

📱 Mídia

Engenheiro(a) de Dados responsável pela criação de pipelines de MLOps com Databricks para as plataformas digitais orientadas por IA da Compass UOL. Atuação com pipelines de dados escaláveis, automação do ciclo de vida dos modelos e organização do Delta Lake.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Ontem

Rimini Street

1001 - 5000

💼 Consultoria

🏥 Saúde

📦 Logística

Engenheiro(a) de Dados de IA responsável por desenvolver pipelines de RAG, infraestrutura vetorial e arquitetura de conhecimento. Impulsionará a Agentic ERP Platform da Rimini Street para o suporte a software corporativo.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 2 dias atrás

tapouts

11 - 50

📚 Educação

🧘 Bem-estar

Engenheiro(a) de Dados Sênior responsável por desenvolver uma infraestrutura de dados escalável em cloud para a tapouts, uma organização dedicada ao bem-estar infantil. Desenvolvimento de pipelines, dashboards, arquiteturas de lakehouse e workflows de dados para ML.

🗣️🇺🇸🇬🇧 Inglês obrigatório