Ingénieur·e senior en clusters HPC et IA

🔥 il y a 24 minutes

🌐 Suisse, Royaume-Uni, +3 autres pays – Distant

infoinfo

⏰ Temps Plein

🟠 Senior

🤖 Intelligence Artificielle

👻 Score fantôme 11%

infoinfo

🗣️🇺🇸🇬🇧 Anglais requis

Postuler Maintenant
Trouver des Emplois à Distance Similaires

📊 Vérifiez votre score de CV pour ce poste

Améliorez vos chances d'obtenir un entretien en vérifiant votre score de CV avant de postuler.

Logo of NVIDIA

NVIDIA

10 000+ employés

Fondée en 1993

🏥 Santé

🏭 Fabrication

🤖 Intelligence artificielle

Healthcare • Manufacturing • Artificial Intelligence

NVIDIA est une entreprise technologique de premier plan, spécialisée dans le calcul accéléré et l’intelligence artificielle (IA). NVIDIA est à l’avant‑garde des avancées en GPU (processeurs graphiques), cloud computing, centres de données et réalité virtuelle, avec un accent particulier sur les secteurs du gaming, de l’automobile, de la santé et de la robotique. Ses innovations, telles que NVIDIA Omniverse, transforment les processus numériques traditionnels en permettant des simulations haute fidélité et des tâches de rendu de pointe. Ses applications couvrent de nombreux secteurs, des véhicules autonomes avec NVIDIA DRIVE aux solutions de santé avec NVIDIA Clara, ainsi que des analyses et workflows pilotés par l’IA.

Description

• Concevoir, déployer et maintenir des clusters HPC/IA à grande échelle, avec des solutions de monitoring, de journalisation et d’alerte • Gérer la planification et l’orchestration des tâches et des workloads Linux • Développer et maintenir des pipelines d’intégration et de déploiement continus • Développer des outils pour automatiser le déploiement et la gestion d’environnements d’infrastructure à grande échelle • Automatiser le monitoring opérationnel et les alertes, et permettre la consommation des ressources en self-service • Déployer des solutions de monitoring pour les serveurs, les réseaux et le stockage • Diagnostiquer les incidents, du bare metal au système d’exploitation, à la stack logicielle et au niveau applicatif • Développer, redéfinir et documenter les méthodologies standard à destination des équipes internes • Accompagner les activités de recherche et développement, et participer aux proofs of concept et proofs of value • Apporter une expertise en conception et en tuning des systèmes pour les calculs à grande échelle • Collaborer avec des chercheurs scientifiques, des développeurs, des clients et des spécialistes HPC, systèmes d’exploitation, calcul GPU et systèmes afin de concevoir, développer et mettre en service des plateformes de calcul haute performance à grande échelle

🎯 Exigences

• Diplôme en informatique, en ingénierie ou dans un domaine connexe • Au moins 8 ans d’expérience • Connaissance des technologies de solutions HPC et IA, des CPU et GPU aux interconnexions haut débit et aux logiciels associés • Expérience de la planification des workloads et des outils d’orchestration tels que Slurm et Kubernetes • Excellente maîtrise de Windows et Linux, notamment Red Hat/CentOS et Ubuntu • Connaissance des réseaux, des sockets, de firewalld, d’iptables, de Wireshark, des ACL, des mécanismes de sécurité au niveau du système d’exploitation, de TCP, de DHCP et de DNS • Expérience des solutions de stockage telles que Lustre, GPFS et Weka.io • Expérience en programmation Python et en scripting Bash • Expérience avec Jenkins, Ansible, Puppet ou Chef • Expertise approfondie des protocoles réseau InfiniBand et Ethernet • Expérience des systèmes virtualisés tels que VMware, Hyper-V, KVM ou Citrix • Familiarité avec AWS, Azure ou Google Cloud • Atout : connaissance de l’architecture des CPU et/ou des GPU • Atout : connaissance de Kubernetes et des technologies de microservices liées aux conteneurs • Atout : expérience des matériels et logiciels dédiés aux GPU, tels que DGX et CUDA • Atout : expérience des fabrics RDMA, notamment InfiniBand ou RoCE

🏖️ Avantages

• Employeur garantissant l’égalité des chances • Des aménagements raisonnables sont proposés aux personnes en situation de handicap afin de leur permettre de participer au processus de candidature ou d’entretien, d’exercer les fonctions essentielles du poste et de bénéficier des autres avantages et droits liés à l’emploi

Postuler Maintenant