Senior Data Engineer

🔥 vor 42 Minuten

🌐 Deutschland, Polen – Remote

infoinfo

⏰ Vollzeit

🟠 Senior

🚰 Dateningenieur

👻 Geisterscore 12%

infoinfo

🗣️🇺🇸🇬🇧 Englisch erforderlich

Airflow

BigQuery

Cloud

ETL

PySpark

Python

Spark

SQL

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of Sigma Software Group

Sigma Software Group

1001 - 5000 Mitarbeiter

Gegründet 2002

💼 Beratung

🏥 Gesundheitswesen

🚘 Automobilindustrie

Consulting • Healthcare • Automotive

Die Sigma Software Group ist ein multinationales Unternehmen, das 2002 gegründet wurde und sich auf hochwertige Softwareentwicklung, Grafikdesign, Testing und Support-Services spezialisiert hat. Das Unternehmen liefert Lösungen für unterschiedlichste Branchen, darunter Automotive, Telekommunikation, Luftfahrt, Werbung, Gaming, Banking, Immobilien und Gesundheitswesen. Sigma Software fördert die berufliche Weiterentwicklung, bietet weltweit Remote-Work-Möglichkeiten und betreut renommierte Kundinnen und Kunden wie AstraZeneca, Scania und SAS. Das Unternehmen legt Wert auf eine Kultur der kontinuierlichen Weiterbildung, des Mentorings und flexibler Arbeitsumgebungen – und ist damit ein bevorzugter Arbeitgeber für IT-Spezialistinnen und -Spezialisten, die an komplexen Lösungen mit Cutting-Edge-Technologien arbeiten möchten. Sigma Software steht für innovative Lösungen und gestaltet die Zukunft des Engineerings mit – und engagiert sich zugleich gesellschaftlich, unter anderem durch karitative Arbeit in der Ukraine.

Beschreibung

• Verfassen und verteidigen Sie diagnostische SQL-Abfragen für umfangreiche Produktionsdatensätze • Entwickeln und pflegen Sie Ingestion-Pipelines für Bid-, Win- und Impression-Logs in BigQuery • Harmonisieren Sie Felder über unabhängig entwickelte Datensätze hinweg und pflegen Sie versionierte Feldzuordnungen • Entwickeln Sie zum jeweiligen Zeitpunkt korrekte Feature-Tabellen und Aggregations-Pipelines • Konzipieren und pflegen Sie Conversion- und Labeling-Pipelines unter Berücksichtigung verzögert verfügbarer Labels • Verantworten Sie den Write Path für die Datenbereitstellung, Schema-Verträge, Publishing-Prozesse und Freshness-SLOs • Entwickeln Sie eine Infrastruktur für Experimente, einschließlich Traffic-Splitting und Reporting-Pipelines • Führen Sie umfangreiche historische Backfills und eine sichere erneute Verarbeitung nach Änderungen an Feldzuordnungen durch • Implementieren Sie Maßnahmen zur Datenisolierung und sicheren Aggregation zum Schutz von Werbekundendaten • Entwickeln Sie automatisierte Frameworks zur Validierung der Datenqualität • Arbeiten Sie eng mit Customer Engineers zusammen und erstellen Sie Betriebsdokumentation • Beteiligen Sie sich an Architekturentscheidungen und an der Verbesserung der Plattformskalierbarkeit

🎯 Anforderungen

• Mindestens 5 Jahre Berufserfahrung im Data Engineering • Mindestens 2 Jahre Erfahrung mit produktiven ML- oder umfangreichen Analytics-Pipelines • Hervorragende SQL-Kenntnisse, einschließlich Window Functions und inkrementeller Verarbeitung • Sehr gute Python-Kenntnisse für die Entwicklung produktionsreifer Pipelines • Praktische Erfahrung mit Spark oder PySpark • Erfahrung in der Entwicklung von ETL-/ELT-Pipelines mit Airflow, Cloud Composer, Dagster oder vergleichbaren Tools • Erfahrung mit Cloud Data Warehouses im großen Maßstab, vorzugsweise BigQuery • Ausgeprägtes Verständnis von Datenmodellierung und zeitpunktbezogener Korrektheit • Erfahrung mit ereignisgesteuerten oder Clickstream-Datensätzen im sehr großen Maßstab • Erfahrung in der Betreuung geschäftskritischer Produktions-Pipelines • Englischkenntnisse auf dem Niveau B2 oder höher

🏖️ Vorteile

• Möglichkeit zur Arbeit im Homeoffice • Möglichkeit, an wirkungsvollen globalen Produkten zu arbeiten • Zusammenarbeit mit erfahrenen Engineers • Möglichkeit, Architekturentscheidungen mitzugestalten • Möglichkeit, Fachkenntnisse in umfangreichen verteilten Systemen und modernen Datenplattformen auszubauen

Jetzt Bewerben

Ähnliche Jobs

🔥 vor 15 Stunden

M&M Software GmbH

201 - 500

💼 Beratung

📣 Marketing

📦 Logistik

Senior Data Engineer zur Entwicklung skalierbarer Datenlösungen mit Databricks, Spark und Python. Unterstützung der Kunden von M&M Software bei der digitalen Transformation durch governte, produktionsreife Datenprodukte.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🔥 vor 23 Stunden

PROMOS consult

201 - 500

💼 Beratung

📦 Logistik

🏥 Gesundheitswesen

SAP-Spezialist (m/w/d) für Datenmigration und Entwicklung für S/4HANA-Migrationen sowie ABAP-Anwendungen. Entwicklung digitaler Softwarelösungen für die Wohnungs-, Bau- und Immobilienwirtschaft bei PROMOS consult.

🕒 vor 3 Tagen

praxipal

11 - 50

🏥 Gesundheitswesen

💼 Beratung

📦 Logistik

Softwareentwickler (m/w/d) für skalierbare Integrationen in praxipals KI-basierte Verwaltungsplattform für das Gesundheitswesen, Luna. Verbesserung der Zuverlässigkeit über verschiedene Praxisverwaltungssysteme hinweg zur Automatisierung von Abläufen in Arztpraxen.

🇩🇪 Deutschland – Remote

💵 €70.000 - €100.000 / Jahr

🔥 Finanzierung im letzten Jahr

💰 €6.700.000 Seed im 2025-10

⏰ Vollzeit

🟠 Senior

🚰 Dateningenieur

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 5 Tagen

Rhenus Logistics

10.000+ Mitarbeiter

🚘 Automobilindustrie

💼 Beratung

🏥 Gesundheitswesen

Azure Data Engineer zum Aufbau und zur Optimierung der Azure-Datenplattform von Rhenus Overland Transport. Entwicklung von Lösungen mit Databricks, PySpark, ETL/ELT, Infrastruktur und CI/CD.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 6 Tagen

Rogon Technologies GmbH

11 - 50

🤖 Künstliche Intelligenz

⚽ Sport

🎮 Gaming

Senior Data Engineer zum Aufbau der Datenbasis für KI-gestütztes Fußball-Scouting bei CUJU. Entwicklung von Pipelines, Kennzahlen und Analytics-Infrastruktur für Sportler, Vereine und Produktteams.

🗣️🇺🇸🇬🇧 Englisch erforderlich

Amazon Redshift

AWS

BigQuery

Cloud

Python

SQL