Databricks Lakehouse Engenheiro(a) de Dados | Sênior (Remote)

Vaga não está no LinkedIn

🕒 Julho 31

🇧🇷 Brasil – Remoto

⏰ Tempo Integral

🟠 Sênior

🚰 Engenheiro de Dados

👻 Score fantasma 29%

infoinfo

🗣️🇧🇷🇵🇹 Português obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Compass

Compass

10.000+ funcionários

🏠 Imobiliário

📱 Mídia

Real Estate • Media

A Compass é um site focado em conteúdo e serviços imobiliários que oferece análises de mercado detalhadas, guias de compra/venda/aluguel, informações sobre hipotecas e financiamentos, além de conselhos sobre melhoria e renovação de imóveis. O site disponibiliza recursos para compradores de imóveis, vendedores, locatários, agentes e investidores imobiliários — incluindo artigos sobre avaliações, moradia acessível, estratégias de investimento, encenação e manutenção de propriedades. A Compass visa ajudar os usuários a tomarem decisões informadas ao longo do ciclo de vida habitacional através de atualizações de mercado oportunas e conteúdo prático de "como fazer".

Descrição

• Colaborar na construção da plataforma Enterprise Lakehouse em Databricks, estruturada em domínios de dados conforme os princípios de Data Mesh. • Implementar e administrar o Unity Catalog como camada de governança central e o compartilhamento de dados entre domínios via Delta Sharing. • Desenvolver padrões de ingestão de dados (streaming e batch) e o template de arquitetura medalhão (bronze/silver/gold) para uso dos domínios. • Desenvolver o framework de contrato de dados e o framework de Data Quality da plataforma. • Estruturar esteiras de CI/CD para a plataforma Databricks e automação de infraestrutura. • Integrar a plataforma Databricks ao produto Data Mesh existente na AWS, garantindo interoperabilidade de catálogos e aderência ao modelo de contrato de dados. • Contribuir com decisões de arquitetura, documentação técnica e mentoria do time.

🎯 Requisitos

• Databricks: experiência sólida com a plataforma — administração de workspaces, clusters, jobs e workflows; • Unity Catalog: governança de dados, modelo de permissões, lineage, external locations e integração com storage; • Delta Lake e arquitetura medalhão (bronze, silver, gold) em ambientes produtivos; • Padrões de ingestão de dados: streaming e batch em escala; • CI/CD para Databricks (Databricks Asset Bundles, Repos, integração com esteiras como GitHub Actions, Azure DevOps ou similares); • Ecossistema AWS: S3, Glue, Lake Formation, EMR (EC2 e Serverless), Athena, Lambda, IAM, DMS, Kinesis, Step Functions, SNS, SQS e EventBridge; • IaC (Terraform, incluindo o provider do Databricks); • Python e PySpark avançados para desenvolvimento de pipelines e automações de plataforma; • SQL avançado; • Data Contracts e ferramentas de metadados como OpenMetadata; • DataDog : para controles e monitoramentos de observabilidade; • Desejáveis: • Vivência em projetos de Data Mesh (domínios, data products, governança federada) — diferencial importante; • Experiência no mercado financeiro ou de crédito — diferencial importante; • Observabilidade e monitoramento de plataformas de dados (system tables, métricas de jobs, qualidade de dados); • FinOps: monitoramento, alocação e otimização de custos em Databricks (DBUs, dimensionamento de clusters, políticas de compute); • Delta Sharing em cenários cross-company, cross-cloud ou cross-region; • Certificações AWS (ex.: Data Engineer Associate, Solutions Architect); • Certificações Databricks (Data Engineer Associate, Data Engineer Professional, Platform Administrator); • Especificações abertas de contrato de dados (Open Data Contract Standard, ODPS).

🏖️ Benefícios

• Vaga também para PcD

Candidatar-se

Vagas Similares

🕒 Julho 30

Sigma Software Group

1001 - 5000

💼 Consultoria

🏥 Saúde

🚘 Automotivo

Engenheiro(a) de Dados construindo soluções de dados escaláveis para plataformas de E-commerce de alto tráfego no Brasil. Colaboração com equipes multifuncionais em tecnologias modernas de nuvem e arquiteturas de dados em grande escala.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 30

Sonepar

10.000+ funcionários

🤝 B2B

📦 Logística

Engenheiro(a) de Dados responsável por construir pipelines escaláveis para a Sonepar, líder na distribuição B2B de materiais elétricos. Desenvolvimento de soluções com Python, SQL, Spark e Databricks.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Julho 30

Keep IT Simple

11 - 50

📦 Logística

🏥 Saúde

🔒 Cibersegurança

Engenheiro de Dados com experiência em Oracle Data Integrator atuando em projetos corporativos de integração de dados de forma remota para comercialização de energia. Buscamos um profissional hands-on, apaixonado por tecnologia.

🗣️🇧🇷🇵🇹 Português obrigatório

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Julho 29

Five Acts

51 - 200

💼 Consultoria

📣 Marketing

📦 Logística

Engenheiro(a) de Dados focado em IA desenvolvendo e mantendo pipelines de dados para soluções analíticas. Integrando fontes, garantindo qualidade e colaborando com equipes de BI e Observability.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Julho 29

Leega

201 - 500

💼 Consultoria

📣 Marketing

🔌 API

Engenheiro de Dados responsável por projetar e implementar lógicas complexas de dados e otimizar a performance no BigQuery. Focado na modernização de ferramentas AWS, garantindo integridade dos dados e testes automatizados.

🗣️🇺🇸🇬🇧 Inglês obrigatório