
201 - 500 funcionários
Fundada em 2010
💼 Consultoria
📣 Marketing
🔌 API
Consulting • Marketing • API
A Leega é uma provedora líder de soluções de tecnologia na América Latina, especializada em analytics de dados e soluções em nuvem. Primeira empresa na região certificada pelo Google Cloud em Data Analytics, a Leega oferece um portfólio de serviços que inclui desenvolvimento de aplicações, machine learning e analytics para gestão de riscos. A empresa faz parcerias com os principais provedores de nuvem, como AWS e Microsoft Azure, para ajudar as empresas a aprimorar a gestão de dados e realizar uma migração eficiente para a nuvem, impulsionando a transformação digital e a inovação.
🔥 12 horas atrás
🗣️🇧🇷🇵🇹 Português obrigatório
Airflow
Apache
AWS
Azure
Cloud
Docker
ETL
Google Cloud Platform
Kubernetes
PySpark
Python
Spark
SQL
Terraform
Unity
Vault
Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

201 - 500 funcionários
Fundada em 2010
💼 Consultoria
📣 Marketing
🔌 API
Consulting • Marketing • API
A Leega é uma provedora líder de soluções de tecnologia na América Latina, especializada em analytics de dados e soluções em nuvem. Primeira empresa na região certificada pelo Google Cloud em Data Analytics, a Leega oferece um portfólio de serviços que inclui desenvolvimento de aplicações, machine learning e analytics para gestão de riscos. A empresa faz parcerias com os principais provedores de nuvem, como AWS e Microsoft Azure, para ajudar as empresas a aprimorar a gestão de dados e realizar uma migração eficiente para a nuvem, impulsionando a transformação digital e a inovação.
• Construir e evoluir a nova plataforma de dados da empresa, baseada em DBT sobre Databricks • Projetar e implementar a arquitetura da plataforma dbt sobre Databricks, incluindo Unity Catalog e camadas medallion (bronze/silver/gold) • Estruturar o projeto DBT com padrões de modelagem, naming, camadas, macros, testes e documentação • Aplicar modelagem dimensional (Kimball, star schema) e/ou Data Vault conforme a necessidade • Construir pipelines de CI/CD para DBT via GitHub Actions, incluindo validação, build, testes e deploy em dev/staging/prod • Automatizar provisionamento e operação via IaC (Terraform) e Databricks Asset Bundles • Desenvolver e manter Workflows no Databricks para orquestração de pipelines • Gerenciar ambientes reproduzíveis com versionamento de código usando Git, GitFlow ou trunk-based • Otimizar custo e performance de clusters, SQL Warehouses, Photon, particionamento e modelos incrementais • Trabalhar com Delta Lake, Parquet e formatos de dados distribuídos • Explorar Apache Spark e PySpark para casos além do SQL quando necessário • Definir governança e segurança de dados, incluindo Unity Catalog, controle de acesso e masking de dados sensíveis • Garantir compliance com LGPD e boas práticas de privacidade de dados • Mentorar o time em boas práticas de engenharia analítica • Revisar código (PRs) e garantir a qualidade técnica das entregas • Atuar em ambientes ágeis e colaborativos
• DBT Core: modelos incrementais, snapshots, macros (Jinja), testes, packages, exposures — mín. 4 anos • Databricks: Unity Catalog, SQL Warehouses, clusters, Delta Lake, Workflows — mín. 4 anos • Apache Spark e processamento distribuído de dados • Python e SQL avançado • GitHub Actions para CI/CD de pipelines de dados • Databricks Asset Bundles para empacotamento e deploy • Git e fluxo colaborativo (trunk-based ou GitFlow, PRs, code review) • Cloud computing — preferencialmente GCP (Azure ou AWS também aceitos) • Ferramentas de ETL/ELT e integração de dados • Cultura de testes automatizados, versionamento e deploy reproduzível • dbt Fusion / migração para dbt Core 2.0 — diferencial • Terraform e IaC para gerenciamento de ambientes e secrets — diferencial • Orquestração com Airflow ou Dagster — desejável • Kubernetes e containers (Docker) — desejável • Observabilidade de dados: dbt docs, Elementary, Monte Carlo, OpenLineage — desejável • Experiência com mascaramento de dados sensíveis / LGPD e compliance — desejável • Modelagem dimensional Kimball / star schema / Data Vault — desejável
• Convênio Médico Porto Seguro, com possibilidade de incluir cônjuge e filhos • Convênio Odontológico Porto Seguro para colaboradores e dependentes • Participação nos Lucros e Resultados (PLR) • Auxílio Creche • Vale Alimentação e Refeição Alelo • Auxílio Home Office • Parcerias com Instituições de Ensino, com descontos e incentivos em cursos e graduações • Incentivo para Certificações, inclusive em Cloud (GCP, Azure, AWS, entre outras) • Pontos Livelo • TotalPass, com planos de academia com desconto para colaboradores e familiares • Mindself, com incentivo à meditação e ao Mindfulness • Trabalho 100% remoto • Capacitação constante
Candidatar-se🔥 12 horas atrás
Engenheiro(a) Líder de Dados responsável por evoluir a plataforma de dados AWS da Experian em escala de petabytes. Construção de pipelines e serviços escaláveis para soluções de marketing orientadas por dados de próxima geração.
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 Ontem
Engenheiro(a) de Dados Especialista apoiando a exploração, limpeza e análise de dados na Stefanini. Construção de pipelines em Python/PySpark e dashboards para apoiar decisões orientadas por dados.
🗣️🇧🇷🇵🇹 Português obrigatório
🕒 Ontem
Engenheiro(a) de Dados responsável pela criação de pipelines de MLOps com Databricks para as plataformas digitais orientadas por IA da Compass UOL. Atuação com pipelines de dados escaláveis, automação do ciclo de vida dos modelos e organização do Delta Lake.
🗣️🇧🇷🇵🇹 Português obrigatório
🕒 Ontem
Engenheiro(a) de Dados de IA responsável por desenvolver pipelines de RAG, infraestrutura vetorial e arquitetura de conhecimento. Impulsionará a Agentic ERP Platform da Rimini Street para o suporte a software corporativo.
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 2 dias atrás
Engenheiro(a) de Dados Sênior responsável por desenvolver uma infraestrutura de dados escalável em cloud para a tapouts, uma organização dedicada ao bem-estar infantil. Desenvolvimento de pipelines, dashboards, arquiteturas de lakehouse e workflows de dados para ML.
🗣️🇺🇸🇬🇧 Inglês obrigatório