
2 - 10 Mitarbeiter
🤖 Künstliche Intelligenz
☁️ SaaS
📱 Medien
💰 €90.000.000 Series B im 2025-01
Artificial Intelligence • SaaS • Media
Luma AI ist ein in Palo Alto ansässiges Unternehmen, das multimodale generative KI-Modelle und kreative Workflow-Tools entwickelt, die sich auf die Produktion von Video, Bild, Audio und Text konzentrieren. Luma bietet Modelle und Produkte wie Ray (Videogenerierung), UNI-1/Uni-1. 1 (Markenintelligenzmodelle) und eine API/Unternehmenslösungen, die es kreativen Teams ermöglichen, cineastische Qualitätsassets mit Markenanpassung zu erzeugen, zu bearbeiten und zu steuern. Sie legen Wert auf Pionierforschung (Open Physical AI Lab), interne Modellentwicklung und Produkte für kreative Teams, Agenturen und Produktionsservices. Luma bietet zudem APIs, Unternehmenspläne, ein kreatives Partnerprogramm und Lernressourcen an.
🔥 vor 12 Stunden
🗣️🇺🇸🇬🇧 Englisch erforderlich
Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

2 - 10 Mitarbeiter
🤖 Künstliche Intelligenz
☁️ SaaS
📱 Medien
💰 €90.000.000 Series B im 2025-01
Artificial Intelligence • SaaS • Media
Luma AI ist ein in Palo Alto ansässiges Unternehmen, das multimodale generative KI-Modelle und kreative Workflow-Tools entwickelt, die sich auf die Produktion von Video, Bild, Audio und Text konzentrieren. Luma bietet Modelle und Produkte wie Ray (Videogenerierung), UNI-1/Uni-1. 1 (Markenintelligenzmodelle) und eine API/Unternehmenslösungen, die es kreativen Teams ermöglichen, cineastische Qualitätsassets mit Markenanpassung zu erzeugen, zu bearbeiten und zu steuern. Sie legen Wert auf Pionierforschung (Open Physical AI Lab), interne Modellentwicklung und Produkte für kreative Teams, Agenturen und Produktionsservices. Luma bietet zudem APIs, Unternehmenspläne, ein kreatives Partnerprogramm und Lernressourcen an.
• Verantworten, wie die Modelle von Luma über die Integration in die Inference Engine, die Skalierung von Deployments und die Auslastung der GPU-Flotte bereitgestellt werden • Neue Modellarchitekturen in die Inference Engine integrieren • Mit den Bereichen Forschung, Engineering und Infrastruktur zusammenarbeiten, um Modelleffizienz und Deployments zu optimieren • Interne Tools zur Messung, Profilierung und Nachverfolgung von Inference-Jobs und Workflows entwickeln • Inference-Services für Verfügbarkeit und Zuverlässigkeit automatisieren, testen und warten • Inference-Workloads über Cluster und Hardwareanbieter hinweg verwalten und optimieren • Deployments über Tausende von Maschinen skalieren • Scheduling-Systeme entwickeln, die GPU-Ressourcen unter Einhaltung der SLOs optimal nutzen • CI/CD für Model-Checkpoints und SDKs betreiben und pflegen • In den ersten 30 Tagen den Inference-Stack kennenlernen und Zuverlässigkeits- oder Auslastungsprobleme diagnostizieren • Zwischen Tag 30 und 60 ein Modell integrieren oder Verbesserungen an Tools bzw. Scheduling umsetzen • Zwischen Tag 60 und 90 Deployment-Pipelines und Scheduling über Cluster und Anbieter hinweg stabilisieren und absichern
• Sehr gute Kenntnisse in Python und Systemarchitektur • Erfahrung mit dem Deployment von Modellen mit PyTorch, Hugging Face, vLLM, SGLang, TensorRT-LLM oder vergleichbaren Technologien • Erfahrung mit Queues, Scheduling, Traffic-Steuerung und Flottenmanagement im großen Maßstab • Erfahrung mit Linux, Docker und Kubernetes • Erfahrung mit Orchestrierung, Deployment und Scheduling • Vertrautheit mit Redis und S3-kompatiblem Storage • Von Vorteil: moderne Netzwerk-Stacks einschließlich RDMA (RoCE, InfiniBand, NVLink) • Von Vorteil: hochperformante ML-Systeme im großen Maßstab (100+ GPUs) • Von Vorteil: CUDA sowie FFmpeg oder Multimedia-Verarbeitung
• Arbeitgeber der Chancengleichheit • Die Teilnahme an einer freiwilligen Umfrage zu Vielfalt und Inklusion ist möglich; eine Nichtteilnahme hat keinen Einfluss auf die Bewerbung • Möglichkeit zur Remote-Arbeit
Jetzt Bewerben🔥 vor 15 Stunden
Softwareentwickler (m/w/d) für die Entwicklung von Echtzeit-Anti-Abuse- und Trust-Systemen für die Entwickler-E-Mail-Plattform von Resend. Entwicklung von Erkennungs-, Durchsetzungs- und ML-Pipelines zum Schutz legitimer Absender.
🇪🇺 Europa – Remote
💵 $150.000 - $175.000 / Jahr
💰 €3.000.000 Seed Round im 2023-07
⏰ Vollzeit
🟡 Mittelstufe
🟠 Senior
🧑💻 Full-Stack-Entwickler
🗣️🇺🇸🇬🇧 Englisch erforderlich
🕒 vor 3 Tagen
Senior-Full-Stack-Entwickler für die Entwicklung einer multimodalen Logistikplattform bei Innovecs. Entwicklung von Angular- und Node.js-Funktionen, APIs, Automatisierungen und KI-gestützten Engineering-Workflows.
🗣️🇺🇸🇬🇧 Englisch erforderlich
🕒 vor 7 Tagen
Softwareentwickler/in für die Entwicklung von EDB Postgres Distributed, der Multi-Master-PostgreSQL-Lösung von EDB. Konzeption von Replikationsfunktionen, Verbesserung der Performance und Betreuung von Enterprise-Datenbankkunden.
🇪🇺 Europa – Remote
💰 Venture Round im 2019-10
⏰ Vollzeit
🟡 Mittelstufe
🟠 Senior
🧑💻 Full-Stack-Entwickler
🗣️🇺🇸🇬🇧 Englisch erforderlich
🕒 vor 8 Tagen
Leitende Softwareentwicklerin bzw. leitender Softwareentwickler für die Entwicklung von ThriveCarts KI-gestütztem E-Commerce-Conversion-Editor. Verantwortung für die Umsetzung von Editor 2.0, den stabilen Produktionsbetrieb und KI-Funktionen zur Verbesserung der Conversions von Händlerinnen und Händlern.
🗣️🇺🇸🇬🇧 Englisch erforderlich
🕒 vor 8 Tagen
Senior Scala Engineer für die Entwicklung von GraphQL-APIs und Event-Gateways für Zartis’ Kunden aus dem Bereich erneuerbare Energien. Unterstützung von Kubernetes-Deployments, CI/CD und der Infrastrukturautomatisierung.
🗣️🇺🇸🇬🇧 Englisch erforderlich