Engenheiro(a) de Dados de IA III

🕒 Agosto 26

🇧🇷 Brasil – Remoto

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🚰 Engenheiro de Dados

👻 Score fantasma 11%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Rimini Street

Rimini Street

1001 - 5000 funcionários

Fundada em 2005

💼 Consultoria

🏥 Saúde

📦 Logística

Consulting • Healthcare • Logistics

Rimini Street é líder global em suporte e serviços para software empresarial, fornecendo soluções de suporte de ponta a ponta para sistemas de missão crítica. A empresa é especializada em reduzir custos de suporte, preencher lacunas de competências tecnológicas e oferecer orientação estratégica de roadmap para prolongar a vida útil dos investimentos em ERP e impulsionar o crescimento dos negócios. Com ofertas que incluem serviços gerenciados e profissionais, soluções de segurança, interoperabilidade e serviços de conformidade, a Rimini Street dá suporte a softwares empresariais amplamente utilizados, como Oracle, SAP, Salesforce, Microsoft e outros. Ao aproveitar sua ampla equipe interna de engenharia, a Rimini Street oferece aos clientes um suporte incomparável, garantindo altos níveis de satisfação e redução de custos.

Descrição

• Construir a camada de conhecimento da Agentic ERP Platform da Rimini Street • Projetar e desenvolver pipelines de RAG que recuperem contexto relevante para as respostas de agentes de IA • Implementar pipelines de chunking, recuperação híbrida, reformulação de consultas, avaliação de recuperação e reranking • Implementar e gerenciar armazenamento vetorial com PostgreSQL e pgvector • Avaliar modelos de embeddings e desenvolver pipelines escaláveis de embeddings • Implementar indexação incremental e arquiteturas vetoriais multi-tenant • Monitorar e otimizar latência, precisão e utilização de recursos da busca vetorial • Ingerir conhecimento do Salesforce, ServiceNow, repositórios de documentação, arquivos de e-mail e logs de transações de ERP • Desenvolver processos de ETL para limpar, normalizar e enriquecer dados brutos • Desenvolver pipelines de extração de PDF, análise de HTML e normalização de dados estruturados • Desenvolver conectores para Salesforce, ServiceNow, SharePoint e Confluence • Implementar monitoramento de qualidade de dados, alertas e rastreamento de linhagem • Projetar a arquitetura de conhecimento com base no modelo Four-Spoke • Desenvolver knowledge graphs, modelos de relacionamento e taxonomias de metadados • Projetar estratégias de versionamento do conhecimento e ciclos de feedback para melhoria contínua • Integrar com o Snowflake e desenvolver pipelines entre sistemas operacionais, Snowflake e armazenamentos vetoriais • Implementar padrões seguros de acesso a dados, respeitando o isolamento dos clientes • Projetar a sincronização entre o data warehouse em cloud e os sistemas de recuperação em tempo real • Otimizar padrões de consulta para processamento econômico em grande escala • Reportar-se ao(à) Diretor(a) Sênior de Engenharia • Colaborar com Engenheiros(as) de GenAI e explicar decisões de arquitetura de dados a stakeholders técnicos e não técnicos

🎯 Requisitos

• Mais de 5 anos de experiência em engenharia de dados • Pelo menos 1 a 2 anos de experiência focada em pipelines de dados de IA/ML ou sistemas de RAG • Experiência prática na construção e otimização de pipelines de RAG em ambientes de produção • Forte experiência com bancos de dados vetoriais, embeddings e busca por similaridade • Experiência com pipelines de ETL/ELT e integração de dados provenientes de diversos sistemas de origem • Experiência em produção com PostgreSQL e processamento de dados baseado em SQL • Conhecimentos em Python para processamento de dados e desenvolvimento de pipelines • Python para engenharia de dados: pandas, pipelines de processamento de dados e programação assíncrona • PostgreSQL com domínio avançado de SQL, incluindo JSONB, busca full-text e extensões • Experiência com bancos de dados vetoriais e embeddings, incluindo pgvector ou similares • Conhecimento de conceitos de RAG: estratégias de chunking, modelos de embeddings, métodos de recuperação e reranking • Experiência com padrões de ETL/ELT e ferramentas de orquestração como Airflow, Dagster ou Prefect • Modelagem de dados para casos de uso relacionais e orientados a documentos • Controle de versão com Git e práticas de CI/CD para pipelines de dados • Conhecimento de integração com APIs REST ou GraphQL para extração de dados • Inglês fluente, escrito e falado • Desejável graduação ou mestrado em Ciência da Computação, Ciência de Dados ou área relacionada • Experiência em empresas de software corporativo ou plataformas B2B SaaS • Conhecimentos em recuperação de informação, sistemas de busca ou NLP • Certificações em Snowflake, AWS Data Engineering ou similares • Contribuições para projetos open source de dados ou IA/ML

🏖️ Benefícios

• Remuneração, bônus e benefícios compatíveis com as habilidades de profissionais de alto desempenho • Viagens mínimas; viagens ocasionais para reuniões da equipe ou treinamentos • Ambiente de trabalho remoto • Ambiente diverso e inclusivo • Igualdade de oportunidades de emprego • Participação nas iniciativas comunitárias e filantrópicas da Rimini Street Foundation

Candidatar-se

Vagas Similares

🕒 Agosto 26

Stefanini Brasil

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Engenheiro(a) de Dados responsável por sustentar e evoluir pipelines para soluções de IA. Atuação com Python, SQL, Airflow, Azure Data Factory, Spark e Databricks no Grupo Stefanini.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Agosto 25

Stefanini Brasil

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Engenheiro de Dados responsável por sustentar e evoluir pipelines para projetos de IA na Stefanini. Atuando com Python, SQL, Airflow, Azure Data Factory, Spark e Databricks.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Agosto 23

Power Digital Marketing

501 - 1000

💼 Consultoria

👥 B2C

📣 Marketing

Engenheiro(a) de Dados responsável por criar pipelines, modelos e camadas semânticas preparados para IA para os clientes de marketing da Power Digital. Utilizará dbt, Python, SQL, Snowflake e workflows de desenvolvimento agentivo com IA.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🕒 Agosto 22

ASURIS

51 - 200

💼 Consultoria

🔒 Cibersegurança

🤝 B2B

Engenheiro(a) de Dados Sênior atuando em migração e engenharia de dados no Azure Databricks. Automatizando pipelines e garantindo governança, desempenho e integridade em ambientes críticos.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Agosto 21

Sicredi

10.000+ funcionários

🛡️ Seguros

📦 Logística

💼 Consultoria

Engenheiro(a) de Dados responsável por projetar arquiteturas e pipelines para a infraestrutura cloud do Sicredi. Garantirá soluções escaláveis, seguras e resilientes para as operações de seguros.

🗣️🇧🇷🇵🇹 Português obrigatório