
10 000+ employés
Fondée en 1993
🏥 Santé
🏭 Fabrication
🤖 Intelligence artificielle
Healthcare • Manufacturing • Artificial Intelligence
NVIDIA est une entreprise technologique de premier plan, spécialisée dans le calcul accéléré et l’intelligence artificielle (IA). NVIDIA est à l’avant‑garde des avancées en GPU (processeurs graphiques), cloud computing, centres de données et réalité virtuelle, avec un accent particulier sur les secteurs du gaming, de l’automobile, de la santé et de la robotique. Ses innovations, telles que NVIDIA Omniverse, transforment les processus numériques traditionnels en permettant des simulations haute fidélité et des tâches de rendu de pointe. Ses applications couvrent de nombreux secteurs, des véhicules autonomes avec NVIDIA DRIVE aux solutions de santé avec NVIDIA Clara, ainsi que des analyses et workflows pilotés par l’IA.
🔥 il y a 1 heure
🌐 France, Royaume-Uni, +4 autres pays – Distant
💵 zł292 500 - zł507 000 / an
⏰ Temps Plein
🟠 Senior
💻 Ingénieur Solutions
👻 Score fantôme 1%
🗣️🇺🇸🇬🇧 Anglais requis
Améliorez vos chances d'obtenir un entretien en vérifiant votre score de CV avant de postuler.

10 000+ employés
Fondée en 1993
🏥 Santé
🏭 Fabrication
🤖 Intelligence artificielle
Healthcare • Manufacturing • Artificial Intelligence
NVIDIA est une entreprise technologique de premier plan, spécialisée dans le calcul accéléré et l’intelligence artificielle (IA). NVIDIA est à l’avant‑garde des avancées en GPU (processeurs graphiques), cloud computing, centres de données et réalité virtuelle, avec un accent particulier sur les secteurs du gaming, de l’automobile, de la santé et de la robotique. Ses innovations, telles que NVIDIA Omniverse, transforment les processus numériques traditionnels en permettant des simulations haute fidélité et des tâches de rendu de pointe. Ses applications couvrent de nombreux secteurs, des véhicules autonomes avec NVIDIA DRIVE aux solutions de santé avec NVIDIA Clara, ainsi que des analyses et workflows pilotés par l’IA.
• Accompagner les clients EMEA spécialisés dans l’IA native dans le déploiement et l’optimisation de workloads d’inférence à grande échelle sur des clusters GPU multi-nœuds • Concevoir des pipelines d’inférence efficaces pour des modèles MoE denses et clairsemés/latents, en répartissant la charge sur des milliers de GPU • Améliorer l’efficacité de l’inférence grâce à la quantification, au speculative decoding, à la séparation du prefill et du decode, à la gestion du cache KV et à WideEP pour les déploiements MoE de grande ampleur • Collaborer avec les équipes produit de NVIDIA, notamment sur Dynamo, TensorRT-LLM et NIXL, afin d’accélérer la réussite des clients • Animer la communauté des développeurs spécialisés dans l’inférence IA à travers l’EMEA au moyen d’ateliers techniques, de hackathons et d’architectures de référence • Définir l’orientation technique pour une inférence IA évolutive et hautement performante dans des environnements de production exigeants
• Diplôme de niveau master ou doctorat en informatique, ingénierie, calcul haute performance, ou expérience professionnelle équivalente • Au moins 5 ans d’expérience dans l’optimisation de l’inférence des réseaux de neurones • Solide compréhension de l’optimisation de l’inférence des transformers, notamment la quantification, l’inférence désagrégée, le speculative decoding, le continuous batching et l’optimisation du cache KV • Expérience pratique de l’inférence de modèles MoE à grande échelle, notamment du parallelism entre experts, de WideEP, des communications all-to-all, des surcoûts liés au routing et de l’équilibrage de charge à grande échelle • Capacité à échanger efficacement avec des ingénieurs ML, des chercheurs et des architectes systèmes à un niveau technique approfondi • Expérience pratique de NVIDIA Dynamo, NIXL, Grove ou d’outils émergents d’inférence désagrégée • Compréhension des hiérarchies de mémoire GPU et des interconnexions haut débit, notamment NVLink, InfiniBand, RDMA et UCX • Contributions auprès de laboratoires d’IA avancée ou de fournisseurs d’infrastructures IA à grande échelle réalisant de l’inférence sur des milliers de GPU • Publications ou benchmarks consacrés à l’inférence IA à grande échelle
• Rémunération très compétitive • Package complet d’avantages sociaux
Postuler Maintenant🕒 il y a 3 jours
Ingénieur intégration chargé de maintenir un ERP critique chez Capgemini, partenaire de la transformation métier et technologique. Déploiement applicatif, gestion des incidents techniques et modernisation des plateformes.
🕒 il y a 11 jours
Ingénieur solutions transformant les données clients en scoring du churn, tableaux de bord et automatisations pour la plateforme HR Tech internationale d’AssessFirst. Vous influencez la stratégie produit, marketing et business grâce à des insights directement exploitables.
🇫🇷 France – Télétravail
💵 €60 000 - €70 000 / an
⏰ Temps Plein
🟡 Intermédiaire
🟠 Senior
💻 Ingénieur Solutions
🕒 il y a 17 jours
Architecte de solutions senior chargé de concevoir des solutions AWS pour les start-up clientes d’Automat-it à Paris. Pilotage de l’architecture avant-vente, de l’optimisation cloud et des missions AWS en contact direct avec les clients.
🗣️🇺🇸🇬🇧 Anglais requis
🕒 il y a 21 jours
Architecte de solutions concevant des architectures cloud, données et logicielles pour European Dynamics. Élaboration de modèles d'architecture et d'artefacts personnalisés tout en conseillant sur la gouvernance des outils de modélisation pour des clients européens majeurs.
🗣️🇺🇸🇬🇧 Anglais requis
🕒 il y a 27 jours
Ingénieur Solutions faisant la promotion de Veeam Vault et conseillant les clients sur la résilience des données, la reprise après cyberattaque et les architectures cloud publiques. Favorise les victoires techniques, les revues d’architecture et l’adoption stratégique de la plateforme de protection des données de Veeam.
🇫🇷 France – Télétravail
💰 €500 000 000 Private Equity Round en 2019-01
⏰ Temps Plein
🟡 Intermédiaire
🟠 Senior
💻 Ingénieur Solutions
🗣️🇺🇸🇬🇧 Anglais requis