Architecte de solutions senior – Inférence de réseaux neuronaux à grande échelle

Emploi pas sur LinkedIn

🔥 il y a 1 heure

🌐 France, Royaume-Uni, +3 autres pays – Distant

infoinfo

💵 zł292 500 - zł650 000 / an

⏰ Temps Plein

🟠 Senior

💻 Ingénieur Solutions

👻 Score fantôme 1%

infoinfo

🗣️🇺🇸🇬🇧 Anglais requis

Postuler Maintenant
Trouver des Emplois à Distance Similaires

📊 Vérifiez votre score de CV pour ce poste

Améliorez vos chances d'obtenir un entretien en vérifiant votre score de CV avant de postuler.

Logo of NVIDIA

NVIDIA

10 000+ employés

Fondée en 1993

🏥 Santé

🏭 Fabrication

🤖 Intelligence artificielle

Healthcare • Manufacturing • Artificial Intelligence

NVIDIA est une entreprise technologique de premier plan, spécialisée dans le calcul accéléré et l’intelligence artificielle (IA). NVIDIA est à l’avant‑garde des avancées en GPU (processeurs graphiques), cloud computing, centres de données et réalité virtuelle, avec un accent particulier sur les secteurs du gaming, de l’automobile, de la santé et de la robotique. Ses innovations, telles que NVIDIA Omniverse, transforment les processus numériques traditionnels en permettant des simulations haute fidélité et des tâches de rendu de pointe. Ses applications couvrent de nombreux secteurs, des véhicules autonomes avec NVIDIA DRIVE aux solutions de santé avec NVIDIA Clara, ainsi que des analyses et workflows pilotés par l’IA.

Description

• Piloter la stratégie d’inférence pour un portefeuille de clients AI Natives de la région EMEA, en accompagnant les projets de la première preuve de concept jusqu’aux déploiements à l’échelle de la production • Identifier les défis liés à l’inférence dans les déploiements clients, notamment en matière de latence, d’efficacité, de coût par token, d’utilisation de la mémoire et de réseaux à faible latence • Concevoir et optimiser des pipelines d’inférence haute performance à l’aide de NVIDIA Dynamo, TensorRT-LLM, vLLM, SGLang et d’autres backends d’inférence • Améliorer l’utilisation des GPU et l’efficacité des clusters d’IA • Transformer les retours clients et les schémas de déploiement en recommandations produit concrètes • Élaborer la feuille de route de la stack NVIDIA, notamment pour Dynamo, TensorRT-LLM et NIM • Définir l’orientation technique de l’inférence IA dans la région EMEA • Fédérer les parties prenantes de NVIDIA et des organisations clientes afin d’influencer les décisions technologiques stratégiques liées à l’inférence IA de nouvelle génération à grande échelle

🎯 Exigences

• Diplôme de niveau master ou doctorat en informatique, en ingénierie ou expérience équivalente dans le domaine • Au moins 8 ans d’expérience dans les infrastructures d’IA/ML, avec une expertise approfondie de l’optimisation de l’inférence des LLM/VLM et des déploiements en production à grande échelle • Excellente compréhension de l’accélération de l’inférence des architectures Transformer : quantification (INT4/FP8), speculative decoding, inférence désagrégée, continuous batching, optimisation du cache KV et WideEP pour les modèles MoE • Bonne compréhension des hiérarchies de mémoire des GPU et des réseaux à faible latence, ainsi que de leur influence sur les performances d’inférence • Expérience avérée dans le pilotage d’initiatives techniques • Excellentes aptitudes en communication, avec une capacité à travailler efficacement avec des chercheurs en IA, des ingénieurs infrastructure et des membres de comités de direction • Expérience de la stack d’inférence NVIDIA, notamment TensorRT-LLM, Triton Inference Server, NIM et NVIDIA Dynamo • Expérience de l’orchestration de GPU sur Kubernetes • Expérience de l’exploitation de systèmes d’inférence à grande échelle au sein d’un laboratoire d’IA de pointe ou d’une équipe d’inférence d’un hyperscaler • Contributions à des projets open source dédiés à l’inférence, tels que vLLM, SGLang, KServe ou NVIDIA Dynamo

🏖️ Avantages

• Rémunération très compétitive • Package complet d’avantages sociaux

Postuler Maintenant

Emplois Similaires

🕒 il y a 3 jours

Capgemini

10 000+ employés

💼 Conseil

🏥 Santé

📦 Logistique

Ingénieur intégration chargé de maintenir un ERP critique chez Capgemini, partenaire de la transformation métier et technologique. Déploiement applicatif, gestion des incidents techniques et modernisation des plateformes.

🕒 il y a 11 jours

AssessFirst 🦄

51 - 200

👥 RH Tech

🤖 Intelligence artificielle

☁️ SaaS

Ingénieur solutions transformant les données clients en scoring du churn, tableaux de bord et automatisations pour la plateforme HR Tech internationale d’AssessFirst. Vous influencez la stratégie produit, marketing et business grâce à des insights directement exploitables.

🇫🇷 France – Télétravail

💵 €60 000 - €70 000 / an

⏰ Temps Plein

🟡 Intermédiaire

🟠 Senior

💻 Ingénieur Solutions

🕒 il y a 17 jours

Automat-it

51 - 200

💼 Conseil

📦 Logistique

📣 Marketing

Architecte de solutions senior chargé de concevoir des solutions AWS pour les start-up clientes d’Automat-it à Paris. Pilotage de l’architecture avant-vente, de l’optimisation cloud et des missions AWS en contact direct avec les clients.

🗣️🇺🇸🇬🇧 Anglais requis

🕒 il y a 21 jours

EUROPEAN DYNAMICS

501 - 1000

💼 Conseil

📦 Logistique

📣 Marketing

Architecte de solutions concevant des architectures cloud, données et logicielles pour European Dynamics. Élaboration de modèles d'architecture et d'artefacts personnalisés tout en conseillant sur la gouvernance des outils de modélisation pour des clients européens majeurs.

🗣️🇺🇸🇬🇧 Anglais requis

🕒 il y a 27 jours

Veeam Software

1001 - 5000

💼 Conseil

📦 Logistique

☁️ SaaS

Ingénieur Solutions faisant la promotion de Veeam Vault et conseillant les clients sur la résilience des données, la reprise après cyberattaque et les architectures cloud publiques. Favorise les victoires techniques, les revues d’architecture et l’adoption stratégique de la plateforme de protection des données de Veeam.

🇫🇷 France – Télétravail

💰 €500 000 000 Private Equity Round en 2019-01

⏰ Temps Plein

🟡 Intermédiaire

🟠 Senior

💻 Ingénieur Solutions

🗣️🇺🇸🇬🇧 Anglais requis

AWS

Azure

Cloud

Vault

VMware