Senior Data Engineer

🔥 vor 21 Stunden

🌐 Deutschland, Polen – Remote

infoinfo

⏰ Vollzeit

🟠 Senior

🚰 Dateningenieur

👻 Geisterscore 12%

infoinfo

🗣️🇺🇸🇬🇧 Englisch erforderlich

Airflow

BigQuery

Cloud

ETL

PySpark

Python

Spark

SQL

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of Sigma Software Group

Sigma Software Group

1001 - 5000 Mitarbeiter

Gegründet 2002

💼 Beratung

🏥 Gesundheitswesen

🚘 Automobilindustrie

Consulting • Healthcare • Automotive

Die Sigma Software Group ist ein multinationales Unternehmen, das 2002 gegründet wurde und sich auf hochwertige Softwareentwicklung, Grafikdesign, Testing und Support-Services spezialisiert hat. Das Unternehmen liefert Lösungen für unterschiedlichste Branchen, darunter Automotive, Telekommunikation, Luftfahrt, Werbung, Gaming, Banking, Immobilien und Gesundheitswesen. Sigma Software fördert die berufliche Weiterentwicklung, bietet weltweit Remote-Work-Möglichkeiten und betreut renommierte Kundinnen und Kunden wie AstraZeneca, Scania und SAS. Das Unternehmen legt Wert auf eine Kultur der kontinuierlichen Weiterbildung, des Mentorings und flexibler Arbeitsumgebungen – und ist damit ein bevorzugter Arbeitgeber für IT-Spezialistinnen und -Spezialisten, die an komplexen Lösungen mit Cutting-Edge-Technologien arbeiten möchten. Sigma Software steht für innovative Lösungen und gestaltet die Zukunft des Engineerings mit – und engagiert sich zugleich gesellschaftlich, unter anderem durch karitative Arbeit in der Ukraine.

Beschreibung

• Diagnose-SQL-Abfragen für umfangreiche Produktionsdatensätze schreiben und fachlich vertreten • Ingestion-Pipelines für Bid-, Win- und Impression-Logs in BigQuery entwickeln und warten • Felder aus unabhängig entworfenen Datensätzen harmonisieren und versionierte Feldzuordnungen pflegen • Zum jeweiligen Zeitpunkt korrekte Feature-Tabellen und Aggregationspipelines entwickeln • Conversion- und Labeling-Pipelines mit Verarbeitung verzögert verfügbarer Labels entwerfen und warten • Für den Schreibpfad der Datenbereitstellung, Schema-Verträge, Veröffentlichungsprozesse und Freshness-SLOs verantwortlich sein • Experimentierinfrastruktur einschließlich Traffic-Splitting und Reporting-Pipelines aufbauen • Umfangreiche historische Backfills und sichere Neuverarbeitungen nach Änderungen an Feldzuordnungen durchführen • Maßnahmen zur Datenisolierung und sicheren Aggregation zum Schutz von Werbekundendaten implementieren • Automatisierte Frameworks zur Validierung der Datenqualität entwickeln • Eng mit Customer Engineers zusammenarbeiten und Betriebsdokumentation erstellen • Zu Architekturentscheidungen und Verbesserungen der Plattformskalierbarkeit beitragen

🎯 Anforderungen

• Mindestens 5 Jahre Erfahrung im Data Engineering • Mindestens 2 Jahre Erfahrung mit produktiven ML- oder Analytics-Pipelines in großem Maßstab • Sehr gute SQL-Kenntnisse, einschließlich Window Functions und Mustern für inkrementelle Verarbeitung • Fundierte Python-Kenntnisse für die Entwicklung produktionsreifer Pipelines • Praktische Erfahrung mit Spark oder PySpark • Erfahrung im Entwurf von ETL-/ELT-Pipelines mit Airflow, Cloud Composer, Dagster oder vergleichbaren Tools • Erfahrung mit Cloud Data Warehouses im großen Maßstab, vorzugsweise BigQuery • Ausgeprägtes Verständnis von Datenmodellierung und zeitpunktgenauer Korrektheit • Erfahrung mit ereignisgesteuerten oder Clickstream-Datensätzen in sehr großem Maßstab • Erfahrung in der Betreuung geschäftskritischer Produktionspipelines • Englischkenntnisse auf gehobenem mittlerem Niveau oder höher

🏖️ Vorteile

• Möglichkeit zur Arbeit im Homeoffice • Möglichkeit, an wirkungsvollen globalen Produkten zu arbeiten • Zusammenarbeit mit erfahrenen Engineers • Möglichkeit, zu Architekturentscheidungen beizutragen • Möglichkeit, Fachkenntnisse in großen verteilten Systemen und modernen Datenplattformen auszubauen

Jetzt Bewerben

Ähnliche Jobs

🕒 vor 2 Tagen

Rhenus Logistics

10.000+ Mitarbeiter

🚘 Automobilindustrie

💼 Beratung

🏥 Gesundheitswesen

Azure Data Engineer zum Aufbau und zur Optimierung der Azure-Datenplattform von Rhenus Overland Transport. Entwicklung von Lösungen mit Databricks, PySpark, ETL/ELT, Infrastruktur und CI/CD.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 3 Tagen

Rogon Technologies GmbH

11 - 50

🤖 Künstliche Intelligenz

⚽ Sport

🎮 Gaming

Senior Data Engineer zum Aufbau der Datenbasis für KI-gestütztes Fußball-Scouting bei CUJU. Entwicklung von Pipelines, Kennzahlen und Analytics-Infrastruktur für Sportler, Vereine und Produktteams.

🗣️🇺🇸🇬🇧 Englisch erforderlich

Amazon Redshift

AWS

BigQuery

Cloud

Python

SQL

🕒 vor 4 Tagen

QAVION GROUP

1 - 10

💼 Beratung

📦 Logistik

🏭 Fertigung

Senior AI-/ML-/Data Engineer zur Entwicklung von ML-, NLP-, LLM- und RAG-Lösungen für die Beratungs- und Technologie-Boutique QAVION. Entwicklung semantischer Suchlösungen, von GenAI-Services und skalierbaren Datenpipelines.

🇩🇪 Deutschland – Remote

💵 €80.000 - €150.000 / Jahr

⏰ Vollzeit

🟠 Senior

🚰 Dateningenieur

🕒 vor 11 Tagen

Tieto

10.000+ Mitarbeiter

💼 Beratung

☁️ SaaS

🤖 Künstliche Intelligenz

Senior Data Engineer zum Aufbau skalierbarer Cloud-Datenplattformen und Datenpipelines bei Tieto Tech Consulting, einem digitalen Beschleuniger für Software Engineering und Business Design. Beratung von Kunden und Entwicklung zuverlässiger datengetriebener Lösungen.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 11 Tagen

Tieto

10.000+ Mitarbeiter

💼 Beratung

☁️ SaaS

🤖 Künstliche Intelligenz

Senior Data Engineer für den Aufbau skalierbarer Cloud-Datenplattformen und Datenpipelines bei Tieto Tech Consulting, einem digitalen Beschleuniger, der Business Design mit Software Engineering verbindet. Sie beraten Kunden und realisieren datengetriebene Lösungen.

🗣️🇺🇸🇬🇧 Englisch erforderlich