Databricks Data Engineer| Senior | (Remote)

Vaga não está no LinkedIn

🕒 Agosto 1

🇧🇷 Brasil – Remoto

⏰ Tempo Integral

🟠 Sênior

🚰 Engenheiro de Dados

👻 Score fantasma 30%

infoinfo

🗣️🇧🇷🇵🇹 Português obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Compass

Compass

10.000+ funcionários

🏠 Imobiliário

📱 Mídia

Real Estate • Media

A Compass é um site focado em conteúdo e serviços imobiliários que oferece análises de mercado detalhadas, guias de compra/venda/aluguel, informações sobre hipotecas e financiamentos, além de conselhos sobre melhoria e renovação de imóveis. O site disponibiliza recursos para compradores de imóveis, vendedores, locatários, agentes e investidores imobiliários — incluindo artigos sobre avaliações, moradia acessível, estratégias de investimento, encenação e manutenção de propriedades. A Compass visa ajudar os usuários a tomarem decisões informadas ao longo do ciclo de vida habitacional através de atualizações de mercado oportunas e conteúdo prático de "como fazer".

Descrição

• Reconstruir os pipelines do DW legado em Databricks (PySpark / Spark SQL), a partir das especificações geradas pela engenharia reversa; • Implementar as camadas bronze, silver e gold seguindo o template medalhão, os padrões de ingestão (CDC/batch) e o padrão de reconstrução definidos pelo projeto; • Executar as waves de reconstrução por domínio, em coexistência com o DW legado até o cutover; • Implementar regras de negócio e transformações com testes automatizados nos pipelines; • Realizar a reconciliação e a validação de paridade dos dados entre o DW legado e o Lakehouse; • Otimizar performance e custo dos pipelines (particionamento, OPTIMIZE/Z-ORDER, dimensionamento de jobs); • Contribuir com a documentação técnica das regras migradas e apoiar a priorização das waves.

🎯 Requisitos

• Experiência mínima de 5 anos em Engenharia de Dados; • PySpark e Python avançados: desenvolvimento de pipelines batch em escala, com testes e boas práticas de engenharia; • SQL avançado e modelagem de dados: transformações complexas, tuning de performance e modelagem relacional/dimensional em contexto de DW; • Databricks e Delta Lake: jobs, workflows e arquitetura medalhão (bronze, silver, gold) em produção; Delta Live Tables / Lakeflow e Asset Bundles; • Migração / reconstrução de pipelines ETL: tradução de regras de negócio de ferramentas legadas para Spark (sem lift-and-shift), com ingestão CDC/batch de bancos relacionais; • Ecossistema AWS: S3, Glue, EMR, Athena, Lambda, DMS e Step Functions; • Azure Synapse: experiência com o ambiente legado (SQL pools e pipelines) para apoiar a engenharia reversa; • Qualidade e reconciliação de dados: testes automatizados, DQ gates e comparação legado × novo para aceite de paridade; • Git e CI/CD aplicados a pipelines de dados. • Conhecimento de DataStage (leitura de jobs para engenharia reversa) — diferencial importante; • Experiência prévia em programas de migração de DW para lakehouse — diferencial importante; • Unity Catalog (permissões, lineage) e contratos de dados; • Experiência no mercado financeiro ou de crédito; • Certificações Databricks (Data Engineer Associate / Professional).

Candidatar-se

Vagas Similares

🕒 Julho 31

CI&T

5001 - 10000

💼 Consultoria

🏥 Saúde

📣 Marketing

Engenheiro(a) de Dados na CI&T ajudando empresas com soluções de dados escaláveis utilizando IA e tecnologias de nuvem.

🇧🇷 Brasil – Remoto

💰 $5.500.000 Venture Round em 2014-04

⏰ Tempo Integral

🟠 Sênior

🚰 Engenheiro de Dados

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 31

Sigma Software Group

1001 - 5000

💼 Consultoria

🏥 Saúde

🚘 Automotivo

Engenheiro(a) de Dados desenvolvendo soluções de dados escaláveis para um projeto de e-commerce de alto impacto. Colabora com equipes multifuncionais em fluxos de dados em larga escala e tecnologias modernas de nuvem.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 30

Sigma Software Group

1001 - 5000

💼 Consultoria

🏥 Saúde

🚘 Automotivo

Engenheiro(a) de Dados construindo soluções de dados escaláveis para plataformas de E-commerce de alto tráfego no Brasil. Colaboração com equipes multifuncionais em tecnologias modernas de nuvem e arquiteturas de dados em grande escala.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 30

Sonepar

10.000+ funcionários

🤝 B2B

📦 Logística

Engenheiro(a) de Dados responsável por construir pipelines escaláveis para a Sonepar, líder na distribuição B2B de materiais elétricos. Desenvolvimento de soluções com Python, SQL, Spark e Databricks.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Julho 30

Keep IT Simple

11 - 50

📦 Logística

🏥 Saúde

🔒 Cibersegurança

Engenheiro de Dados com experiência em Oracle Data Integrator atuando em projetos corporativos de integração de dados de forma remota para comercialização de energia. Buscamos um profissional hands-on, apaixonado por tecnologia.

🗣️🇧🇷🇵🇹 Português obrigatório

🗣️🇺🇸🇬🇧 Inglês obrigatório