Engenheiro de Dados

🔥 5 minutos atrás

🇧🇷 Brasil – Remoto

⏰ Tempo Integral

🟡 Pleno

🟠 Sênior

🚰 Engenheiro de Dados

👻 Score fantasma 10%

infoinfo

🗣️🇧🇷🇵🇹 Português obrigatório

Candidatar-se
Encontrar Vagas Remotas Similares

📊 Verifique sua pontuação de currículo para esta vaga

Melhore suas chances de conseguir uma entrevista verificando sua pontuação de currículo antes de se candidatar.

Logo of Distrito

Distrito

51 - 200 funcionários

Fundada em 2014

🤖 Inteligência Artificial

💼 Consultoria

📚 Educação

💰 Seed em 2020-12

Artificial Intelligence • Consulting • Education

Distrito é uma empresa brasileira focada na transformação e adoção de IA de ponta a ponta. Oferece estratégia e governança em IA, educação executiva e técnica em IA (Dominar IA para Negócios / Tecnologia), e serviços de implementação através de uma Fábrica de IA e Squads de IA que constroem soluções personalizadas e escaláveis, como modelos preditivos e agentes autônomos. O Distrito também opera um ecossistema de IA (GenAI Lab, Plataforma ÍON), publica relatórios, realiza eventos e opera um Hub físico de Transformação em IA em São Paulo. A empresa atende grandes corporações e startups em diversos setores (exemplos em bens de consumo, saúde, infraestrutura/utilidades e seguros) e enfatiza governança, engenharia de dados e resultados mensuráveis; reporta mais de 80 projetos de IA implementados e 3 mil profissionais treinados.

Descrição

• Construir pipelines de ingestão batch e streaming • Estruturar data lakes e data warehouses • Criar datasets otimizados para ML • Implementar pipelines de embeddings • Construir indexação vetorial para RAG • Garantir qualidade, governança e segurança de dados • Otimizar custo de armazenamento e processamento • Trabalhar com AI Engineers para estruturar feature stores

🎯 Requisitos

• Linguagens: Python • SQL avançado • Scala (opcional) • Apache Airflow • dbt • Prefect • Spark • Pandas • PySpark • Data Lakes (S3, GCS, Azure Blob) • Data Warehouses (BigQuery, Snowflake, Redshift) • Bancos NoSQL • Bancos vetoriais (Pinecone, Weaviate, FAISS) • Kafka • Pub/Sub • Docker • Kubernetes • Cloud (AWS, GCP ou Azure) • Modelagem de dados • ETL / ELT • Processamento distribuído • Arquitetura de dados escalável • Experiência com dados não estruturados (texto, logs, PDF) • Conceitos de DataOps • Versionamento e qualidade de dados

🏖️ Benefícios

• Vale-refeição e/ou vale-alimentação de R$950,00 por mês no cartão Ifood • Convênio Médico SulAmérica (100% custeado pela empresa) • Plano Odontológico MetLife • Plano de saúde Pet • Seguro de vida • Totalpass e Wellhub para manter as atividades físicas a qualquer hora e lugar • Birthday Day Off para curtir no seu aniversário como quiser • Parceria com o Sesc • Parceria com a OnHappy (descontos em hotéis e passagens) • Parceria com instituições de ensino • Reembolso creche • Equipamentos de trabalho • Cultura de feedback e desenvolvimento • Ambiente dinâmico e com grandes oportunidades de crescimento • Empréstimo consignado com as menores taxas de juros • Remuneração variável em reconhecimento de desempenho, performance e alinhamento de cultura

Candidatar-se

Vagas Similares

🔥 8 horas atrás

Leega

201 - 500

💼 Consultoria

📣 Marketing

🔌 API

Arquiteto(a) de Dados Sênior projetando arquiteturas Lakehouse com GCP e Databricks. A consultoria Leega transforma desafios tecnológicos em soluções de dados e IA.

🗣️🇧🇷🇵🇹 Português obrigatório

🔥 20 horas atrás

Stefanini Brasil

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Engenheiro de Dados Sênior desenvolvendo pipelines escaláveis com Python, Spark e Databricks. Criando soluções de dados para a Stefanini, ecossistema global de tecnologia.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Ontem

Stefanini Brasil

10.000+ funcionários

💼 Consultoria

🏥 Saúde

📦 Logística

Engenheiro(a) de Dados Sênior projetando pipelines e sistemas de dados para a Stefanini. Mantendo os dados acessíveis, confiáveis e prontos para uso.

🗣️🇧🇷🇵🇹 Português obrigatório

Azure

Cloud

Informatica

🕒 Ontem

GFT Technologies

10.000+ funcionários

💼 Consultoria

🛡️ Seguros

🔒 Cibersegurança

Engenheiro(a) Sênior de Dados modernizando processos IBM DataStage para Python e PySpark na AWS. Desenvolvendo pipelines escaláveis e apoiando a evolução da plataforma de dados da GFT.

🗣️🇧🇷🇵🇹 Português obrigatório

🕒 Ontem

Quality Digital

1001 - 5000

💼 Consultoria

📣 Marketing

📦 Logística

Engenheiro(a) de Dados desenvolvendo data pipelines e soluções de IA na Quality Digital, especialista em soluções de TI. Apoio à arquitetura de dados, a modelos generativos e a processos de negócio com IA.

🗣️🇧🇷🇵🇹 Português obrigatório