Softwareentwickler/in für Inferenz

🔥 vor 12 Stunden

🇪🇺 Europa – Remote

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

🧑‍💻 Full-Stack-Entwickler

👻 Geisterscore 12%

infoinfo

🗣️🇺🇸🇬🇧 Englisch erforderlich

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of Luma AI

Luma AI

2 - 10 Mitarbeiter

🤖 Künstliche Intelligenz

☁️ SaaS

📱 Medien

💰 €90.000.000 Series B im 2025-01

Artificial Intelligence • SaaS • Media

Luma AI ist ein in Palo Alto ansässiges Unternehmen, das multimodale generative KI-Modelle und kreative Workflow-Tools entwickelt, die sich auf die Produktion von Video, Bild, Audio und Text konzentrieren. Luma bietet Modelle und Produkte wie Ray (Videogenerierung), UNI-1/Uni-1. 1 (Markenintelligenzmodelle) und eine API/Unternehmenslösungen, die es kreativen Teams ermöglichen, cineastische Qualitätsassets mit Markenanpassung zu erzeugen, zu bearbeiten und zu steuern. Sie legen Wert auf Pionierforschung (Open Physical AI Lab), interne Modellentwicklung und Produkte für kreative Teams, Agenturen und Produktionsservices. Luma bietet zudem APIs, Unternehmenspläne, ein kreatives Partnerprogramm und Lernressourcen an.

Beschreibung

• Verantworten, wie die Modelle von Luma über die Integration in die Inference Engine, die Skalierung von Deployments und die Auslastung der GPU-Flotte bereitgestellt werden • Neue Modellarchitekturen in die Inference Engine integrieren • Mit den Bereichen Forschung, Engineering und Infrastruktur zusammenarbeiten, um Modelleffizienz und Deployments zu optimieren • Interne Tools zur Messung, Profilierung und Nachverfolgung von Inference-Jobs und Workflows entwickeln • Inference-Services für Verfügbarkeit und Zuverlässigkeit automatisieren, testen und warten • Inference-Workloads über Cluster und Hardwareanbieter hinweg verwalten und optimieren • Deployments über Tausende von Maschinen skalieren • Scheduling-Systeme entwickeln, die GPU-Ressourcen unter Einhaltung der SLOs optimal nutzen • CI/CD für Model-Checkpoints und SDKs betreiben und pflegen • In den ersten 30 Tagen den Inference-Stack kennenlernen und Zuverlässigkeits- oder Auslastungsprobleme diagnostizieren • Zwischen Tag 30 und 60 ein Modell integrieren oder Verbesserungen an Tools bzw. Scheduling umsetzen • Zwischen Tag 60 und 90 Deployment-Pipelines und Scheduling über Cluster und Anbieter hinweg stabilisieren und absichern

🎯 Anforderungen

• Sehr gute Kenntnisse in Python und Systemarchitektur • Erfahrung mit dem Deployment von Modellen mit PyTorch, Hugging Face, vLLM, SGLang, TensorRT-LLM oder vergleichbaren Technologien • Erfahrung mit Queues, Scheduling, Traffic-Steuerung und Flottenmanagement im großen Maßstab • Erfahrung mit Linux, Docker und Kubernetes • Erfahrung mit Orchestrierung, Deployment und Scheduling • Vertrautheit mit Redis und S3-kompatiblem Storage • Von Vorteil: moderne Netzwerk-Stacks einschließlich RDMA (RoCE, InfiniBand, NVLink) • Von Vorteil: hochperformante ML-Systeme im großen Maßstab (100+ GPUs) • Von Vorteil: CUDA sowie FFmpeg oder Multimedia-Verarbeitung

🏖️ Vorteile

• Arbeitgeber der Chancengleichheit • Die Teilnahme an einer freiwilligen Umfrage zu Vielfalt und Inklusion ist möglich; eine Nichtteilnahme hat keinen Einfluss auf die Bewerbung • Möglichkeit zur Remote-Arbeit

Jetzt Bewerben

Ähnliche Jobs

🔥 vor 15 Stunden

Resend

1 - 10

💼 Beratung

📣 Marketing

☁️ SaaS

Softwareentwickler (m/w/d) für die Entwicklung von Echtzeit-Anti-Abuse- und Trust-Systemen für die Entwickler-E-Mail-Plattform von Resend. Entwicklung von Erkennungs-, Durchsetzungs- und ML-Pipelines zum Schutz legitimer Absender.

🇪🇺 Europa – Remote

💵 $150.000 - $175.000 / Jahr

💰 €3.000.000 Seed Round im 2023-07

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

🧑‍💻 Full-Stack-Entwickler

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 3 Tagen

Innovecs

501 - 1000

💼 Beratung

📦 Logistik

🏥 Gesundheitswesen

Senior-Full-Stack-Entwickler für die Entwicklung einer multimodalen Logistikplattform bei Innovecs. Entwicklung von Angular- und Node.js-Funktionen, APIs, Automatisierungen und KI-gestützten Engineering-Workflows.

🇪🇺 Europa – Remote

⏰ Vollzeit

🟠 Senior

🧑‍💻 Full-Stack-Entwickler

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 7 Tagen

EDB

501 - 1000

🏢 Unternehmen

🤝 B2B

Softwareentwickler/in für die Entwicklung von EDB Postgres Distributed, der Multi-Master-PostgreSQL-Lösung von EDB. Konzeption von Replikationsfunktionen, Verbesserung der Performance und Betreuung von Enterprise-Datenbankkunden.

🇪🇺 Europa – Remote

💰 Venture Round im 2019-10

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

🧑‍💻 Full-Stack-Entwickler

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 8 Tagen

ThriveCart

11 - 50

💼 Beratung

📣 Marketing

🛍️ eCommerce

Leitende Softwareentwicklerin bzw. leitender Softwareentwickler für die Entwicklung von ThriveCarts KI-gestütztem E-Commerce-Conversion-Editor. Verantwortung für die Umsetzung von Editor 2.0, den stabilen Produktionsbetrieb und KI-Funktionen zur Verbesserung der Conversions von Händlerinnen und Händlern.

🇪🇺 Europa – Remote

💰 Venture Round im 2023-01

⏰ Vollzeit

🟠 Senior

🧑‍💻 Full-Stack-Entwickler

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 8 Tagen

Zartis

201 - 500

💼 Beratung

📦 Logistik

📣 Marketing

Senior Scala Engineer für die Entwicklung von GraphQL-APIs und Event-Gateways für Zartis’ Kunden aus dem Bereich erneuerbare Energien. Unterstützung von Kubernetes-Deployments, CI/CD und der Infrastrukturautomatisierung.

🇪🇺 Europa – Remote

💰 Pre Seed Round im 2011-12

⏰ Vollzeit

🟠 Senior

🧑‍💻 Full-Stack-Entwickler

🗣️🇺🇸🇬🇧 Englisch erforderlich