
10.000+ Mitarbeiter
Gegründet 1993
🏥 Gesundheitswesen
🏭 Fertigung
🤖 Künstliche Intelligenz
Healthcare • Manufacturing • Artificial Intelligence
NVIDIA ist ein führendes Technologieunternehmen mit Spezialisierung auf beschleunigtes Computing und Künstliche Intelligenz (AI). NVIDIA treibt Fortschritte bei Grafikprozessoren (GPUs), Cloud Computing, Rechenzentren und Virtual Reality voran und fokussiert dabei Branchen wie Gaming, Automotive, Gesundheitswesen und Robotik. Innovationen des Unternehmens wie NVIDIA Omniverse transformieren traditionelle digitale Prozesse, indem sie hochrealistische Simulationen und Rendering-Aufgaben ermöglichen. Die Anwendungen erstrecken sich über zahlreiche Branchen – von autonomen Fahrzeugen mit NVIDIA DRIVE über Gesundheitslösungen mit NVIDIA Clara bis hin zu AI-gestützten Analysen und Workflows.
🔥 vor 1 Stunde
🌐 Frankreich, Vereinigtes Königreich, +4 weitere Länder – Remote
💵 zł292.500 - zł507.000 / Jahr
⏰ Vollzeit
🟠 Senior
💻 Lösungsingenieur
👻 Geisterscore 1%
🗣️🇺🇸🇬🇧 Englisch erforderlich
Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

10.000+ Mitarbeiter
Gegründet 1993
🏥 Gesundheitswesen
🏭 Fertigung
🤖 Künstliche Intelligenz
Healthcare • Manufacturing • Artificial Intelligence
NVIDIA ist ein führendes Technologieunternehmen mit Spezialisierung auf beschleunigtes Computing und Künstliche Intelligenz (AI). NVIDIA treibt Fortschritte bei Grafikprozessoren (GPUs), Cloud Computing, Rechenzentren und Virtual Reality voran und fokussiert dabei Branchen wie Gaming, Automotive, Gesundheitswesen und Robotik. Innovationen des Unternehmens wie NVIDIA Omniverse transformieren traditionelle digitale Prozesse, indem sie hochrealistische Simulationen und Rendering-Aufgaben ermöglichen. Die Anwendungen erstrecken sich über zahlreiche Branchen – von autonomen Fahrzeugen mit NVIDIA DRIVE über Gesundheitslösungen mit NVIDIA Clara bis hin zu AI-gestützten Analysen und Workflows.
• Unterstützung von AI-Natives-Kunden in der EMEA-Region bei der Bereitstellung und Optimierung von Inferenz-Workloads in großem Maßstab auf Multi-Node-GPU-Clustern • Entwicklung effizienter Inferenz-Pipelines für dichte und sparsame bzw. latente MoE-Modelle mit Verteilung der Workloads auf Tausende GPUs • Steigerung der Inferenz-Effizienz durch Quantisierung, speculative decoding, disaggregated prefill/decode, KV-Cache-Management und WideEP für umfangreiche MoE-Bereitstellungen • Zusammenarbeit mit NVIDIA-Produktteams, darunter Dynamo, TensorRT-LLM und NIXL, zur Beschleunigung des Kundenerfolgs • Förderung der Entwickler-Community für KI-Inferenz in der EMEA-Region durch technische Workshops, Hackathons und Referenzarchitekturen • Festlegung der technischen Ausrichtung für skalierbare, leistungsstarke KI-Inferenz in anspruchsvollen Produktionsumgebungen
• Masterabschluss oder Promotion in Informatik, Ingenieurwissenschaften, High-Performance Computing oder gleichwertige Berufserfahrung • Mindestens fünf Jahre Erfahrung in der Optimierung der Inferenz neuronaler Netze • Fundierte Kenntnisse der Inferenzoptimierung von Transformer-Modellen, einschließlich Quantisierung, disaggregated inference, speculative decoding, continuous batching und KV-Cache-Optimierung • Praktische Erfahrung mit MoE-Inferenz im großen Maßstab, einschließlich Expert Parallelism, WideEP, All-to-All-Kommunikation, Routing-Overhead und Load-Balancing im großen Maßstab • Fähigkeit zur effektiven Zusammenarbeit mit ML Engineers, Forschenden und Systemarchitekten auf tiefgreifend technischem Niveau • Praktische Erfahrung mit NVIDIA Dynamo, NIXL, Grove oder neuen Tools für disaggregated inference • Verständnis der GPU-Speicherhierarchien und Hochgeschwindigkeitsverbindungen, einschließlich NVLink, InfiniBand, RDMA und UCX • Beiträge zu fortgeschrittenen KI-Laboren oder Anbietern groß angelegter KI-Infrastrukturen, die Inferenz auf Tausenden GPUs durchführen • Veröffentlichte Arbeiten oder Benchmarks zur KI-Inferenz im großen Maßstab
• Sehr attraktive Vergütung • Umfassendes Leistungspaket
Jetzt Bewerben🕒 vor 3 Tagen
Ingénieur intégration maintenant un ERP critique chez Capgemini, partenaire de la transformation business et technologique. Déploiement applicatif, incidents techniques et modernisation des plateformes.
🗣️🇫🇷 Französisch erforderlich
🕒 vor 11 Tagen
Solution Engineer turning customer data into churn scoring, dashboards, and automation for AssessFirst’s global HR Tech platform. Influencing product, marketing, and business strategy through actionable insights.
🗣️🇫🇷 Französisch erforderlich
🕒 vor 17 Tagen
Senior Solutions Architect designing AWS solutions for Automat-it’s startup customers in Paris. Leading pre-sales architecture, cloud optimization, and customer-facing AWS engagements.
🗣️🇫🇷 Französisch erforderlich
🗣️🇺🇸🇬🇧 Englisch erforderlich
🕒 vor 21 Tagen
Solution Architect designing cloud, data, and software architectures for European Dynamics. Developing architecture models and customized artefacts while advising on modelling-tool governance for major European clients.
🗣️🇺🇸🇬🇧 Englisch erforderlich
🕒 vor 27 Tagen
Solutions Engineer evangelizing Veeam Vault and advising customers on data resilience, cyber recovery, and public cloud architectures. Driving technical wins, architecture reviews, and strategic adoption for Veeam’s data protection platform.
🇫🇷 Frankreich – Remote
💰 €500.000.000 Private Equity Round im 2019-01
⏰ Vollzeit
🟡 Mittelstufe
🟠 Senior
💻 Lösungsingenieur
🗣️🇺🇸🇬🇧 Englisch erforderlich