Ingénieur réseau principal (AI Fabric, réseaux de datacenter et de périphérie) – Radian Arc

Emploi pas sur LinkedIn

🔥 il y a 1 heure

🇪🇺 Europe – Télétravail

⏰ Temps Plein

🔴 Expert

🤖 Ingénieur IA

👻 Score fantôme 12%

infoinfo

🗣️🇺🇸🇬🇧 Anglais requis

Postuler Maintenant
Trouver des Emplois à Distance Similaires

📊 Vérifiez votre score de CV pour ce poste

Améliorez vos chances d'obtenir un entretien en vérifiant votre score de CV avant de postuler.

Logo of Submer

Submer

51 - 200 employés

Fondée en 2015

🔧 Matériel

⚡ Énergie

🤝 B2B

Hardware • Energy • B2B

Submer est un fournisseur d'intelligence connectée pour l'infrastructure d'IA, spécialisé dans les solutions avancées de refroidissement liquide/à immersion et de centres de données modulaires. Ils conçoivent, construisent et exploitent des environnements prêts pour l'IA (de l'énergie et du terrain au cloud et edge), fabriquent des pods de refroidissement à immersion (SmartPod EVO/EXO), et proposent des services de GPUaaS/AIaaS et de déploiement modulaire. Submer met l'accent sur les économies d'énergie et d'eau, les architectures thermiques à haute densité pour les charges de travail d'IA exigeantes, et des solutions prêtes pour la souveraineté, déployables à l'échelle mondiale.

Description

• Concevoir, déployer et exploiter l’infrastructure réseau qui alimente une plateforme cloud GPU destinée au cloud gaming, à l’IA et aux applications de machine learning au sein des réseaux d’opérateurs télécoms • Concevoir et exploiter des fabrics réseau GPU hautes performances ainsi que des fabrics RoCE à grande échelle • Optimiser les performances réseau pour les schémas de communication des GPU et le trafic est-ouest • Définir des architectures de référence et des principes de conception réutilisables pour les AI fabrics • Concevoir et exploiter des réseaux de datacenter de couche 2 et de couche 3 à l’aide d’architectures de routage évolutives • Assurer l’isolation des tenants, le routage ingress/egress, la gestion du trafic et la mise en œuvre de réseaux overlay • Déployer et maintenir l’infrastructure de sécurité nord-sud, les protections WAF et les contrôles de sécurité de la plateforme • Concevoir des interconnexions privées, des anneaux de fibre noire, des liaisons WAN haut débit et l’intégration au backbone mondial • Piloter la mise en œuvre technique de bout en bout, de la conception et de la validation en laboratoire jusqu’au déploiement en production • Valider les nomenclatures réseau, contribuer aux plans de datacenter et aux élévations de racks, et piloter la planification des capacités • Définir les standards de déploiement, les critères de validation, les stratégies de rollback et des modèles de recette réutilisables • Être responsable des performances opérationnelles et de la fiabilité du réseau • Automatiser le provisioning, la gestion de configuration, la supervision et la gestion du cycle de vie • Piloter la réponse aux incidents et l’analyse des causes racines lors d’incidents réseau majeurs • Définir et suivre les SLA, les SLO, les indicateurs de fiabilité et les benchmarks opérationnels • Collaborer avec les équipes infrastructure, plateforme, SRE, compute, stockage, observabilité et opérations de datacenter • Agir en tant que référent principal pour la conception réseau et contribuer à l’évolution de la roadmap réseau de la plateforme • Accompagner les ingénieurs et contribuer au développement de la fonction réseau

🎯 Exigences

• Solide expérience pratique dans la conception et l’exploitation de réseaux de datacenter à grande échelle • Maîtrise experte de BGP, OSPF, ECMP et EVPN/VXLAN • Expérience avérée de l’exploitation de réseaux Ethernet haut débit en production • Expérience de l’exploitation de plateformes réseau NVIDIA/Mellanox • Expertise approfondie dans la conception et l’exploitation de fabrics réseau pour des clusters GPU à grande échelle et des workloads d’IA distribués • Compréhension approfondie des schémas de communication de NCCL • Expérience du tuning de fabrics RoCE • Solide connaissance du comportement des transports RDMA et de leurs modes de défaillance • Expérience pratique de la mise en œuvre et du tuning de PFC et d’ECN • Compréhension des schémas de communication collective des GPU • Expérience de la conception de fabrics réseau GPU optimisées pour les rails • Compréhension de l’impact des performances réseau sur PyTorch et TensorFlow • Capacité à diagnostiquer des problèmes cross-layer impliquant le matériel, le firmware, le réseau du kernel et les couches de communication des applications distribuées • Solide connaissance du matériel réseau, des composants optiques et des interconnexions haut débit • Expérience de la conception de systèmes d’observabilité réseau • Solides compétences en automatisation avec Python et/ou Bash • Expérience de l’application des pratiques du software engineering à l’automatisation de l’infrastructure • Capacité avérée à piloter des initiatives techniques complexes impliquant plusieurs équipes • Capacité démontrée à définir une orientation architecturale et à favoriser l’adoption de standards d’ingénierie • Solides aptitudes au mentoring • Une expérience de la responsabilité de l’architecture et de sa mise en œuvre directe dans des environnements agiles ou en forte croissance constitue un atout majeur

🏖️ Avantages

• Package de rémunération attractif, à la hauteur de votre expertise et de votre expérience • Environnement de travail flexible • Organisation compatible avec le travail hybride • Environnement de travail international et diversifié • Opportunités d’évolution professionnelle au sein d’une scale-up en forte croissance

Postuler Maintenant

Emplois Similaires

🕒 il y a 6 jours

Virtusa

10 000+ employés

💼 Conseil

🏢 Entreprise

🤖 Intelligence artificielle

Ingénieur IA cloud chargé de concevoir des workflows d’IA agentique et des solutions de machine learning dans le cloud. Mise en œuvre de Vertex AI, du MLOps et de l’IA générative pour des clients informatiques en Europe.

🇪🇺 Europe – Télétravail

💰 €108 000 000 Post-IPO Equity - Virtusa en 2017-05

⏰ Temps Plein

🟠 Senior

🔴 Expert

🤖 Ingénieur IA

🗣️🇺🇸🇬🇧 Anglais requis

Apache

Cloud

ETL

Hadoop

Java

Perl

Python

PyTorch

Spark

Tensorflow

C++

🕒 il y a 1 mois

Wand AI

51 - 200

🤖 Intelligence artificielle

🏢 Entreprise

☁️ SaaS

Ingénieur logiciel principal développant des systèmes d'IA pour la gouvernance chez Wand. Analyse des données organisationnelles et création de workflows à base d'agents avec autonomie.

🇪🇺 Europe – Télétravail

⏰ Temps Plein

🔴 Expert

🤖 Ingénieur IA

🗣️🇺🇸🇬🇧 Anglais requis

Neo4j