
501 - 1000 funcionários
💳 Fintech
👥 RH Tech
☁️ SaaS
💰 $4.000.000 Undisclosed em 2025-01
Fintech • HR Tech • SaaS
A Caju é uma instituição de pagamento e plataforma de RH brasileira que centraliza benefícios para funcionários, gestão de despesas e processos de RH em uma solução única e integrada. Autorizada pelo Banco Central como uma instituição de pagamento, a Caju oferece cartões e um aplicativo móvel, administração de multibenefícios (CLT, PAT, flexível), fluxos de despesas e reembolsos, serviços de mobilidade e bem-estar, e atua como correspondente bancário para empréstimos consignados. A empresa foca em clientes B2B—atendendo desde pequenos a grandes empregadores—para simplificar operações de RH, melhorar o engajamento dos funcionários e proporcionar funcionalidades de serviços financeiros com conformidade regulatória.
🔥 0 minutos atrás
🗣️🇧🇷🇵🇹 Português obrigatório
Airflow
Amazon Redshift
Apache
AWS
DynamoDB
Kafka
Kubernetes
MySQL
Postgres
Pulsar
PySpark
Python
RabbitMQ
SQL
Terraform
Unity
Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

501 - 1000 funcionários
💳 Fintech
👥 RH Tech
☁️ SaaS
💰 $4.000.000 Undisclosed em 2025-01
Fintech • HR Tech • SaaS
A Caju é uma instituição de pagamento e plataforma de RH brasileira que centraliza benefícios para funcionários, gestão de despesas e processos de RH em uma solução única e integrada. Autorizada pelo Banco Central como uma instituição de pagamento, a Caju oferece cartões e um aplicativo móvel, administração de multibenefícios (CLT, PAT, flexível), fluxos de despesas e reembolsos, serviços de mobilidade e bem-estar, e atua como correspondente bancário para empréstimos consignados. A empresa foca em clientes B2B—atendendo desde pequenos a grandes empregadores—para simplificar operações de RH, melhorar o engajamento dos funcionários e proporcionar funcionalidades de serviços financeiros com conformidade regulatória.
• Projetar e manter pipelines de integração heterogênea utilizando Apache Airflow, Dagster, Airbyte, AWS DMS, DBT, Kubernetes, APIs REST, SFTP e conectores diversos para ingestão contínua • Aplicar técnicas avançadas de particionamento, indexação (Z-Ordering/Liquid Clustering), otimização de layout de arquivos e estratégias de escrita/leitura no Amazon S3, Databricks e dbt • Eliminar varreduras excessivas (full table scans), diminuir custos de requisições S3 (GET/LIST) e acelerar o consumo de consultas • Projetar e implementar ingestão de dados em tempo real por tópicos e eventos usando Apache Kafka, AWS Kinesis e Event Hubs • Reduzir a dependência direta de consultas e cargas massivas em bancos relacionais como PostgreSQL e MySQL • Implementar ferramentas, agentes e pipelines de GenAI/LLMs para automatizar tarefas operacionais da engenharia • Projetar, construir e manter pipelines robustos com modelagem dimensional e arquitetura Medallion • Entregar dados limpos, agregados e otimizados para ingestão e consumo • Garantir compliance (LGPD/GDPR), mascaramento de dados sensíveis, lineage, controle de acesso granular e monitoramento de data freshness e data quality • Levantar necessidades junto às áreas de negócio, documentar arquiteturas, definir data contracts e assegurar governança e manutenibilidade dos pipelines
• Experiência sólida em engenharia de dados em ambientes de produção de grande volume e alta criticidade • Domínio prático de estratégias de particionamento, otimização de layouts de dados, compactação, Z-Ordering e otimização de consultas • Experiência com Airflow, Dagster, Airbyte, AWS DMS, dbt, Kubernetes, APIs REST, SFTP e conectores customizados • Vivência com arquiteturas de ingestão baseadas em eventos/tópicos usando Kafka, Kinesis, Pulsar ou RabbitMQ • Domínio avançado de Python, PySpark e SQL otimizado para processamento massivo e distribuído • Experiência profunda com Databricks, Delta Lake, Auto Loader, Structured Streaming, Jobs/Workflows e Medallion Architecture • Vivência em serviços AWS voltados a dados: S3, IAM, Redshift, DynamoDB, Data Catalog e AWS DMS • Conhecimento prático ou forte interesse em ferramentas/LLMs para automação de tarefas de desenvolvimento e engenharia de dados • Vivência com testes automatizados, Git/GitHub, revisão de PRs e pipelines de CI/CD • Domínio em modelagem de dados Dimensional, Star/Snowflake e diretrizes de segurança e privacidade LGPD/GDPR • Diferencial: experiência com pipelines para suporte a IA, chunking, embeddings, Vector Search, Feature Stores e Unity Catalog • Diferencial: experiência com Unity Catalog, Terraform e Databricks Asset Bundles (DAB) • Diferencial: implementação de data contracts e frameworks de qualidade/observabilidade como Great Expectations, Soda, dbt tests e Datadog • Diferencial: gestão de custos em nuvem/Databricks, alertas de anomalias e detecção estatística de data drift • Diferencial: vivência em idempotência, conciliação de saldos e reprocessamento financeiro • Diferencial: experiência em fintech, meios de pagamento ou saúde, com compliance e auditorias de dados
• Cartão Caju, com mais liberdade para usar seus benefícios (Refeição, Alimentação, Mobilidade, Saúde, Home Office, Cultura e Educação) • Plano de Saúde sem coparticipação (Unimed, Sulamerica ou Alice) • Zenklub, com consultas onlines com terapeutas e coaches para cuidar da sua saúde mental • Wellhub • Estímulo ao aprendizado de idiomas, com a parceria da Rosetta Stone • Dia de recarregar - day off • Conexa Saúde - consulta médica online • Auxílio Creche • Parceria com Alura • Trabalho Remoto, para você trabalhar de onde quiser dentro do Brasil • Equipamento de trabalho • Muitas possibilidades de crescimento
Candidatar-se🔥 17 horas atrás
Engenheiro de Dados desenvolvendo pipelines batch e streaming para a Genial Investimentos. Integrando bancos, APIs e serviços AWS no mercado financeiro.
🗣️🇧🇷🇵🇹 Português obrigatório
🔥 18 horas atrás
Engenheiro de Dados Sênior desenvolvendo soluções Hadoop para a Stefanini, empresa global de tecnologia. Criando pipelines escaláveis, protegendo dados e otimizando infraestrutura para análises e ciência de dados.
🗣️🇧🇷🇵🇹 Português obrigatório
🔥 22 horas atrás
Engenheiro de Dados mantendo scrapers em Python/Django, bancos de dados e pipelines de processamento de documentos. Suporta arquivos de tecnologia cívica que lidam com dados judiciais e milhões de registros digitalizados no Brasil.
🗣️🇺🇸🇬🇧 Inglês obrigatório
🕒 Ontem
Engenheiro de Dados FICO construindo e operando pipelines robustos para a GFT, empresa global de tecnologia. Garantindo qualidade, governança e disponibilidade de dados para analytics e decisões de negócio.
🗣️🇧🇷🇵🇹 Português obrigatório
🕒 Ontem
Engenheiro de Dados GCP construindo pipelines e plataformas escaláveis para a consultoria Leega, especializada em Data Analytics, Cloud e IA. Atuando em Build & Run, governança e incidentes de produção.
🗣️🇧🇷🇵🇹 Português obrigatório