Mid-Level Data Engineer

🔥 1 minute ago

🇧🇷 Brazil – Remote

⏰ Full Time

🟡 Mid-level

🟠 Senior

🚰 Data Engineer

👻 Ghost score 10%

infoinfo

🗣️🇧🇷🇵🇹 Portuguese Required

Apply Now
Find Similar Remote Jobs

📊 Check your resume score for this job

Improve your chances of getting an interview by checking your resume score before you apply.

Logo of Stefanini Brasil

Stefanini Brasil

10,000+ employees

💼 Consulting

🏢 Enterprise

🤖 Artificial Intelligence

Consulting • Enterprise • Artificial Intelligence

Stefanini Brasil is the Brazilian arm of Stefanini Group, a global tech consulting and services firm with an AI-first approach. It offers technology and consulting services to modernize and operate IT landscapes, including AI platforms and applications, custom application development, hybrid cloud and infrastructure, cloud migration and management, digital workplace services, enterprise platforms (including the Topaz full-banking platform), data & analytics, cybersecurity, and industry-specific solutions for manufacturing, financial services, retail, telecom and more. Stefanini emphasizes AI-enabled transformation, end-to-end operations and managed services, and partners with large enterprise clients across sectors to deliver digital transformation, automation, and industry solutions.

📋 Description

• Build and maintain ingestion and transformation pipelines for data from APIs, relational databases, files, and data lakes • Develop solutions in Python, SQL, and PySpark using organized, reusable, and testable code • Model data in Delta Lake, applying incremental loads, MERGE operations, and maintenance best practices • Implement Medallion architectures (Bronze, Silver, and Gold) and data quality rules • Orchestrate jobs and pipelines, configuring dependencies, parameters, retries, and alerts • Monitor executions, investigate failures, and diagnose data quality and performance issues • Optimize queries, processing, cluster utilization, and costs, measuring the results of improvements • Apply governance and security practices, including access control and sensitive data protection • Collaborate on code reviews, testing, version control, and deployments across environments

🎯 Requirements

• Hands-on experience with Python, advanced SQL, and PySpark • Experience building and operating data pipelines in Databricks • Knowledge of Delta Lake, including transactions, schema evolution, incremental loads, and update operations • Experience with batch processing; knowledge of streaming is a plus • Knowledge of Medallion architecture and formats such as CSV, JSON, and Parquet • Experience with job orchestration, monitoring, and failure handling • Familiarity with Git, code reviews, and testing • Ability to investigate issues, explain technical decisions, and work independently • Experience with Auto Loader, Structured Streaming, and declarative pipelines • Knowledge of Unity Catalog, data lineage, auditing, and permissions • Experience with AWS, Azure, or Google Cloud • Experience with CI/CD, infrastructure as code, and Databricks Asset Bundles or equivalent tools • Databricks Certified Data Engineer Associate certification

🏖️ Benefits

• Meal allowance or food voucher • Discounts on courses, universities, and language institutions • Stefanini Academy — a platform offering free, up-to-date online courses with certificates • Mentoring • Benefits club offering discounts on medical consultations and examinations • Health insurance • Dental insurance • Benefits and discounts at leading establishments • Travel club • Pet care benefits

Apply Now

Similar Jobs

🔥 4 hours ago

Sigma Software Group

1001 - 5000

💼 Consulting

🏥 Healthcare

🚘 Automotive

Senior/Principal Data Engineer building scalable AWS data platforms for enterprise analytics, reporting, and machine learning. Designing batch and streaming pipelines while guiding architecture and mentoring engineers.

Apache

AWS

Cloud

Distributed Systems

ETL

Java

Kafka

Python

Scala

Spark

SQL

🔥 23 hours ago

Sonepar

10,000+ employees

🤝 B2B

📦 Logistics

Engenheiro de Dados construindo pipelines escaláveis para a Sonepar, líder em distribuição B2B de materiais elétricos. Atuando com Spark, Databricks, Python, SQL e arquitetura Lakehouse.

🗣️🇧🇷🇵🇹 Portuguese Required

Airflow

Apache

Azure

ETL

Python

Spark

SQL

🕒 Yesterday

Compass

10,000+ employees

🏠 Real Estate

📱 Media

Senior Databricks Data Engineer building and modernizing Lakehouse solutions for Compass UOL. Developing scalable Spark pipelines, Medallion architectures, and reliable data platforms.

🗣️🇧🇷🇵🇹 Portuguese Required

Airflow

Apache

AWS

BigQuery

Cassandra

Kafka

MongoDB

NoSQL

Postgres

PySpark

Spark

SQL

Unity

🕒 Yesterday

GFT Technologies

10,000+ employees

💼 Consulting

🛡️ Insurance

🔒 Cybersecurity

Engenheiro de Dados Sênior projetando pipelines ETL/ELT e integrações no ecossistema FICO. Garantindo qualidade, governança e disponibilidade de dados para decisões corporativas na GFT.

🗣️🇧🇷🇵🇹 Portuguese Required

Airflow

Cloud

ETL

MongoDB

NoSQL

Python

Spark

SQL

🕒 Yesterday

GFT Technologies

10,000+ employees

💼 Consulting

🛡️ Insurance

🔒 Cybersecurity

Engenheiro de Dados Sênior desenvolvendo soluções de Business Intelligence na GFT Technologies. Colaboração com clientes e áreas técnicas para definir requisitos e soluções de dados.

🗣️🇧🇷🇵🇹 Portuguese Required

Azure

ETL

Oracle

SQL