Engenheiro(a) de Dados de IA III

Vaga não está no LinkedIn

🔥 0 minutos atrás

🇧🇷 Brasil – Remoto

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🚰 Engenheiro de Dados

👻 Score fantasma 10%

infoinfo

🗣️🇺🇸🇬🇧 Inglês obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Rimini Street

Rimini Street

1001 - 5000 funcionários

Fundada em 2005

💼 Consultoria

🏥 Saúde

📦 Logística

Consulting • Healthcare • Logistics

Rimini Street é líder global em suporte e serviços para software empresarial, fornecendo soluções de suporte de ponta a ponta para sistemas de missão crítica. A empresa é especializada em reduzir custos de suporte, preencher lacunas de competências tecnológicas e oferecer orientação estratégica de roadmap para prolongar a vida útil dos investimentos em ERP e impulsionar o crescimento dos negócios. Com ofertas que incluem serviços gerenciados e profissionais, soluções de segurança, interoperabilidade e serviços de conformidade, a Rimini Street dá suporte a softwares empresariais amplamente utilizados, como Oracle, SAP, Salesforce, Microsoft e outros. Ao aproveitar sua ampla equipe interna de engenharia, a Rimini Street oferece aos clientes um suporte incomparável, garantindo altos níveis de satisfação e redução de custos.

Descrição

• Construir a camada de conhecimento da Agentic ERP Platform da Rimini Street • Projetar e desenvolver pipelines de RAG que recuperem contexto relevante para as respostas de agentes de IA • Implementar pipelines de chunking, recuperação híbrida, reformulação de consultas, avaliação de recuperação e reranking • Implementar e gerenciar armazenamento vetorial com PostgreSQL e pgvector • Avaliar modelos de embeddings e desenvolver pipelines escaláveis de embeddings • Implementar indexação incremental e arquiteturas vetoriais multi-tenant • Monitorar e otimizar latência, precisão e utilização de recursos da busca vetorial • Ingerir conhecimento do Salesforce, ServiceNow, repositórios de documentação, arquivos de e-mail e logs de transações de ERP • Desenvolver processos de ETL para limpar, normalizar e enriquecer dados brutos • Desenvolver pipelines de extração de PDF, análise de HTML e normalização de dados estruturados • Desenvolver conectores para Salesforce, ServiceNow, SharePoint e Confluence • Implementar monitoramento de qualidade de dados, alertas e rastreamento de linhagem • Projetar a arquitetura de conhecimento com base no modelo Four-Spoke • Desenvolver knowledge graphs, modelos de relacionamento e taxonomias de metadados • Projetar estratégias de versionamento do conhecimento e ciclos de feedback para melhoria contínua • Integrar com o Snowflake e desenvolver pipelines entre sistemas operacionais, Snowflake e armazenamentos vetoriais • Implementar padrões seguros de acesso a dados, respeitando o isolamento dos clientes • Projetar a sincronização entre o data warehouse em cloud e os sistemas de recuperação em tempo real • Otimizar padrões de consulta para processamento econômico em grande escala • Reportar-se ao(à) Diretor(a) Sênior de Engenharia • Colaborar com Engenheiros(as) de GenAI e explicar decisões de arquitetura de dados a stakeholders técnicos e não técnicos

🎯 Requisitos

• Mais de 5 anos de experiência em engenharia de dados • Pelo menos 1 a 2 anos de experiência focada em pipelines de dados de IA/ML ou sistemas de RAG • Experiência prática na construção e otimização de pipelines de RAG em ambientes de produção • Forte experiência com bancos de dados vetoriais, embeddings e busca por similaridade • Experiência com pipelines de ETL/ELT e integração de dados provenientes de diversos sistemas de origem • Experiência em produção com PostgreSQL e processamento de dados baseado em SQL • Conhecimentos em Python para processamento de dados e desenvolvimento de pipelines • Python para engenharia de dados: pandas, pipelines de processamento de dados e programação assíncrona • PostgreSQL com domínio avançado de SQL, incluindo JSONB, busca full-text e extensões • Experiência com bancos de dados vetoriais e embeddings, incluindo pgvector ou similares • Conhecimento de conceitos de RAG: estratégias de chunking, modelos de embeddings, métodos de recuperação e reranking • Experiência com padrões de ETL/ELT e ferramentas de orquestração como Airflow, Dagster ou Prefect • Modelagem de dados para casos de uso relacionais e orientados a documentos • Controle de versão com Git e práticas de CI/CD para pipelines de dados • Conhecimento de integração com APIs REST ou GraphQL para extração de dados • Inglês fluente, escrito e falado • Desejável graduação ou mestrado em Ciência da Computação, Ciência de Dados ou área relacionada • Experiência em empresas de software corporativo ou plataformas B2B SaaS • Conhecimentos em recuperação de informação, sistemas de busca ou NLP • Certificações em Snowflake, AWS Data Engineering ou similares • Contribuições para projetos open source de dados ou IA/ML

🏖️ Benefícios

• Remuneração, bônus e benefícios compatíveis com as habilidades de profissionais de alto desempenho • Viagens mínimas; viagens ocasionais para reuniões da equipe ou treinamentos • Ambiente de trabalho remoto • Ambiente diverso e inclusivo • Igualdade de oportunidades de emprego • Participação nas iniciativas comunitárias e filantrópicas da Rimini Street Foundation

Candidatar-se

Vagas Similares

🔥 9 horas atrás

tapouts

11 - 50

📚 Educação

🧘 Bem-estar

Engenheiro(a) de Dados Sênior responsável por desenvolver uma infraestrutura de dados escalável em cloud para a tapouts, uma organização dedicada ao bem-estar infantil. Desenvolvimento de pipelines, dashboards, arquiteturas de lakehouse e workflows de dados para ML.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🔥 10 horas atrás

Onzze

1 - 10

💼 Consultoria

📣 Marketing

📦 Logística

Engenheiro(a) de Dados Sênior responsável por criar pipelines de arquitetura medalhão no Databricks e no Azure para um cliente automotivo global. Garantindo governança, qualidade e CI/CD para viabilizar BI e Data Science.

🗣️🇺🇸🇬🇧 Inglês obrigatório

🗣️🇧🇷🇵🇹 Português obrigatório

🔥 12 horas atrás

Stefanini Brasil

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Engenheiro(a) de Dados responsável por sustentar e evoluir pipelines para soluções de IA. Atuação com Python, SQL, Airflow, Azure Data Factory, Spark e Databricks no Grupo Stefanini.

🗣️🇧🇷🇵🇹 Português obrigatório

🔥 18 horas atrás

Stefanini Brasil

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Engenheiro de Dados responsável por sustentar e evoluir pipelines para projetos de IA na Stefanini. Atuando com Python, SQL, Airflow, Azure Data Factory, Spark e Databricks.

🗣️🇧🇷🇵🇹 Português obrigatório

🔥 21 horas atrás

GFT Technologies

10.000+ funcionários

💼 Consultoria

🛡️ Seguros

🔒 Cibersegurança

Engenheiro(a) de Dados desenvolvendo conectores personalizados e pipelines no Google Cloud. Contribuindo para uma plataforma segura de IA e analytics no setor manufatureiro da GFT.

🗣️🇧🇷🇵🇹 Português obrigatório