Senior Engineer für HPC- und KI-Cluster

🔥 vor 20 Minuten

🌐 Schweiz, Vereinigtes Königreich, +3 weitere Länder – Remote

infoinfo

⏰ Vollzeit

🟠 Senior

🤖 Künstliche Intelligenz

👻 Geisterscore 11%

infoinfo

🗣️🇺🇸🇬🇧 Englisch erforderlich

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of NVIDIA

NVIDIA

10.000+ Mitarbeiter

Gegründet 1993

🏥 Gesundheitswesen

🏭 Fertigung

🤖 Künstliche Intelligenz

Healthcare • Manufacturing • Artificial Intelligence

NVIDIA ist ein führendes Technologieunternehmen mit Spezialisierung auf beschleunigtes Computing und Künstliche Intelligenz (AI). NVIDIA treibt Fortschritte bei Grafikprozessoren (GPUs), Cloud Computing, Rechenzentren und Virtual Reality voran und fokussiert dabei Branchen wie Gaming, Automotive, Gesundheitswesen und Robotik. Innovationen des Unternehmens wie NVIDIA Omniverse transformieren traditionelle digitale Prozesse, indem sie hochrealistische Simulationen und Rendering-Aufgaben ermöglichen. Die Anwendungen erstrecken sich über zahlreiche Branchen – von autonomen Fahrzeugen mit NVIDIA DRIVE über Gesundheitslösungen mit NVIDIA Clara bis hin zu AI-gestützten Analysen und Workflows.

Beschreibung

• Große HPC-/KI-Cluster mit Monitoring, Logging und Alerting konzipieren, implementieren und betreiben • Linux-Auftrags- und Workload-Scheduling sowie Orchestrierungstools verwalten • Continuous-Integration- und Continuous-Delivery-Pipelines entwickeln und pflegen • Tools zur Automatisierung der Bereitstellung und Verwaltung groß angelegter Infrastrukturumgebungen entwickeln • Betriebliches Monitoring und Alerting automatisieren und die Self-Service-Nutzung von Ressourcen ermöglichen • Monitoring-Lösungen für Server, Netzwerke und Speicher bereitstellen • Fehler von der Bare-Metal-Ebene über das Betriebssystem und den Software-Stack bis zur Anwendungsebene analysieren und beheben • Standardmethoden für interne Teams entwickeln, neu definieren und dokumentieren • Forschungs- und Entwicklungsaktivitäten unterstützen sowie an Machbarkeits- und Wertnachweisen (Proof of Concept und Proof of Value) mitwirken • Erkenntnisse zur Systemarchitektur und -optimierung für groß angelegte Rechenläufe liefern • Mit wissenschaftlichen Forschenden, Entwicklern, Kunden sowie Spezialisten für HPC, Betriebssysteme, GPU-Computing und Systeme zusammenarbeiten, um groß angelegte Performance-Plattformen zu konzipieren, zu entwickeln und in Betrieb zu nehmen

🎯 Anforderungen

• Abgeschlossenes Studium der Informatik, Ingenieurwissenschaften oder eines verwandten Fachgebiets • Mindestens 8 Jahre Berufserfahrung • Kenntnisse von HPC- und KI-Lösungstechnologien – von CPUs und GPUs über Hochgeschwindigkeitsverbindungen bis hin zur unterstützenden Software • Erfahrung mit Workload-Scheduling und Orchestrierungstools wie Slurm und Kubernetes • Sehr gute Kenntnisse in Windows und Linux, einschließlich Red Hat/CentOS und Ubuntu • Kenntnisse in Netzwerken, Sockets, firewalld, iptables, Wireshark, ACLs, Schutzmechanismen auf Betriebssystemebene, TCP, DHCP und DNS • Erfahrung mit Speicherlösungen wie Lustre, GPFS und Weka.io • Erfahrung in der Programmierung mit Python und der Erstellung von Bash-Skripten • Erfahrung mit Jenkins, Ansible, Puppet oder Chef • Fundierte Kenntnisse der Netzwerkprotokolle von InfiniBand und Ethernet • Erfahrung mit virtualisierten Systemen wie VMware, Hyper-V, KVM oder Citrix • Vertrautheit mit AWS, Azure oder Google Cloud • Von Vorteil: Kenntnisse der CPU- und/oder GPU-Architektur • Von Vorteil: Kenntnisse in Kubernetes und containerbezogenen Microservice-Technologien • Von Vorteil: Erfahrung mit GPU-spezifischer Hardware und Software wie DGX und CUDA • Von Vorteil: Erfahrung mit RDMA-Fabrics, einschließlich InfiniBand oder RoCE

🏖️ Vorteile

• Arbeitgeber der Chancengleichheit • Angemessene Vorkehrungen für Menschen mit Behinderungen, damit sie am Bewerbungs- oder Vorstellungsgespräch teilnehmen, wesentliche Aufgaben der Stelle ausüben und weitere Leistungen und Vorteile der Beschäftigung in Anspruch nehmen können

Jetzt Bewerben