Pessoa Engenheira de Dados Sênior

Vaga não está no LinkedIn

🔥 0 minutos atrás

🗣️🇧🇷🇵🇹 Português obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Caju

Caju

501 - 1000 funcionários

💳 Fintech

👥 RH Tech

☁️ SaaS

💰 $4.000.000 Undisclosed em 2025-01

Fintech • HR Tech • SaaS

A Caju é uma instituição de pagamento e plataforma de RH brasileira que centraliza benefícios para funcionários, gestão de despesas e processos de RH em uma solução única e integrada. Autorizada pelo Banco Central como uma instituição de pagamento, a Caju oferece cartões e um aplicativo móvel, administração de multibenefícios (CLT, PAT, flexível), fluxos de despesas e reembolsos, serviços de mobilidade e bem-estar, e atua como correspondente bancário para empréstimos consignados. A empresa foca em clientes B2B—atendendo desde pequenos a grandes empregadores—para simplificar operações de RH, melhorar o engajamento dos funcionários e proporcionar funcionalidades de serviços financeiros com conformidade regulatória.

Descrição

• Projetar e manter pipelines de integração heterogênea utilizando Apache Airflow, Dagster, Airbyte, AWS DMS, DBT, Kubernetes, APIs REST, SFTP e conectores diversos para ingestão contínua • Aplicar técnicas avançadas de particionamento, indexação (Z-Ordering/Liquid Clustering), otimização de layout de arquivos e estratégias de escrita/leitura no Amazon S3, Databricks e dbt • Eliminar varreduras excessivas (full table scans), diminuir custos de requisições S3 (GET/LIST) e acelerar o consumo de consultas • Projetar e implementar ingestão de dados em tempo real por tópicos e eventos usando Apache Kafka, AWS Kinesis e Event Hubs • Reduzir a dependência direta de consultas e cargas massivas em bancos relacionais como PostgreSQL e MySQL • Implementar ferramentas, agentes e pipelines de GenAI/LLMs para automatizar tarefas operacionais da engenharia • Projetar, construir e manter pipelines robustos com modelagem dimensional e arquitetura Medallion • Entregar dados limpos, agregados e otimizados para ingestão e consumo • Garantir compliance (LGPD/GDPR), mascaramento de dados sensíveis, lineage, controle de acesso granular e monitoramento de data freshness e data quality • Levantar necessidades junto às áreas de negócio, documentar arquiteturas, definir data contracts e assegurar governança e manutenibilidade dos pipelines

🎯 Requisitos

• Experiência sólida em engenharia de dados em ambientes de produção de grande volume e alta criticidade • Domínio prático de estratégias de particionamento, otimização de layouts de dados, compactação, Z-Ordering e otimização de consultas • Experiência com Airflow, Dagster, Airbyte, AWS DMS, dbt, Kubernetes, APIs REST, SFTP e conectores customizados • Vivência com arquiteturas de ingestão baseadas em eventos/tópicos usando Kafka, Kinesis, Pulsar ou RabbitMQ • Domínio avançado de Python, PySpark e SQL otimizado para processamento massivo e distribuído • Experiência profunda com Databricks, Delta Lake, Auto Loader, Structured Streaming, Jobs/Workflows e Medallion Architecture • Vivência em serviços AWS voltados a dados: S3, IAM, Redshift, DynamoDB, Data Catalog e AWS DMS • Conhecimento prático ou forte interesse em ferramentas/LLMs para automação de tarefas de desenvolvimento e engenharia de dados • Vivência com testes automatizados, Git/GitHub, revisão de PRs e pipelines de CI/CD • Domínio em modelagem de dados Dimensional, Star/Snowflake e diretrizes de segurança e privacidade LGPD/GDPR • Diferencial: experiência com pipelines para suporte a IA, chunking, embeddings, Vector Search, Feature Stores e Unity Catalog • Diferencial: experiência com Unity Catalog, Terraform e Databricks Asset Bundles (DAB) • Diferencial: implementação de data contracts e frameworks de qualidade/observabilidade como Great Expectations, Soda, dbt tests e Datadog • Diferencial: gestão de custos em nuvem/Databricks, alertas de anomalias e detecção estatística de data drift • Diferencial: vivência em idempotência, conciliação de saldos e reprocessamento financeiro • Diferencial: experiência em fintech, meios de pagamento ou saúde, com compliance e auditorias de dados

🏖️ Benefícios

• Cartão Caju, com mais liberdade para usar seus benefícios (Refeição, Alimentação, Mobilidade, Saúde, Home Office, Cultura e Educação) • Plano de Saúde sem coparticipação (Unimed, Sulamerica ou Alice) • Zenklub, com consultas onlines com terapeutas e coaches para cuidar da sua saúde mental • Wellhub • Estímulo ao aprendizado de idiomas, com a parceria da Rosetta Stone • Dia de recarregar - day off • Conexa Saúde - consulta médica online • Auxílio Creche • Parceria com Alura • Trabalho Remoto, para você trabalhar de onde quiser dentro do Brasil • Equipamento de trabalho • Muitas possibilidades de crescimento

Candidatar-se

Vagas Similares

🔥 17 horas atrás

Genial Investimentos

501 - 1000

💼 Consultoria

🛡️ Seguros

💸 Finanças

Engenheiro de Dados desenvolvendo pipelines batch e streaming para a Genial Investimentos. Integrando bancos, APIs e serviços AWS no mercado financeiro.

🗣️🇧🇷🇵🇹 Português obrigatório

🔥 18 horas atrás

Stefanini Brasil

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Engenheiro de Dados Sênior desenvolvendo soluções Hadoop para a Stefanini, empresa global de tecnologia. Criando pipelines escaláveis, protegendo dados e otimizando infraestrutura para análises e ciência de dados.

🗣️🇧🇷🇵🇹 Português obrigatório

🔥 22 horas atrás

Combine | Global Recruitment

11 - 50

🎯 Recrutamento

🤝 B2B

Engenheiro de Dados mantendo scrapers em Python/Django, bancos de dados e pipelines de processamento de documentos. Suporta arquivos de tecnologia cívica que lidam com dados judiciais e milhões de registros digitalizados no Brasil.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Ontem

GFT Technologies

10.000+ funcionários

💼 Consultoria

🛡️ Seguros

🔒 Cibersegurança

Engenheiro de Dados FICO construindo e operando pipelines robustos para a GFT, empresa global de tecnologia. Garantindo qualidade, governança e disponibilidade de dados para analytics e decisões de negócio.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Ontem

Leega

201 - 500

💼 Consultoria

📣 Marketing

🔌 API

Engenheiro de Dados GCP construindo pipelines e plataformas escaláveis para a consultoria Leega, especializada em Data Analytics, Cloud e IA. Atuando em Build & Run, governança e incidentes de produção.

🗣️🇧🇷🇵🇹 Português obrigatório