
10.000+ Mitarbeiter
Gegründet 1993
🏥 Gesundheitswesen
🏭 Fertigung
🤖 Künstliche Intelligenz
Healthcare • Manufacturing • Artificial Intelligence
NVIDIA ist ein führendes Technologieunternehmen mit Spezialisierung auf beschleunigtes Computing und Künstliche Intelligenz (AI). NVIDIA treibt Fortschritte bei Grafikprozessoren (GPUs), Cloud Computing, Rechenzentren und Virtual Reality voran und fokussiert dabei Branchen wie Gaming, Automotive, Gesundheitswesen und Robotik. Innovationen des Unternehmens wie NVIDIA Omniverse transformieren traditionelle digitale Prozesse, indem sie hochrealistische Simulationen und Rendering-Aufgaben ermöglichen. Die Anwendungen erstrecken sich über zahlreiche Branchen – von autonomen Fahrzeugen mit NVIDIA DRIVE über Gesundheitslösungen mit NVIDIA Clara bis hin zu AI-gestützten Analysen und Workflows.
🔥 vor 2 Stunden
🌐 Deutschland, Spanien, +1 weitere Länder – Remote
💵 zł292.500 - zł650.000 / Jahr
⏰ Vollzeit
🟠 Senior
🧑💻 Full-Stack-Entwickler
👻 Geisterscore 1%
🗣️🇺🇸🇬🇧 Englisch erforderlich
Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

10.000+ Mitarbeiter
Gegründet 1993
🏥 Gesundheitswesen
🏭 Fertigung
🤖 Künstliche Intelligenz
Healthcare • Manufacturing • Artificial Intelligence
NVIDIA ist ein führendes Technologieunternehmen mit Spezialisierung auf beschleunigtes Computing und Künstliche Intelligenz (AI). NVIDIA treibt Fortschritte bei Grafikprozessoren (GPUs), Cloud Computing, Rechenzentren und Virtual Reality voran und fokussiert dabei Branchen wie Gaming, Automotive, Gesundheitswesen und Robotik. Innovationen des Unternehmens wie NVIDIA Omniverse transformieren traditionelle digitale Prozesse, indem sie hochrealistische Simulationen und Rendering-Aufgaben ermöglichen. Die Anwendungen erstrecken sich über zahlreiche Branchen – von autonomen Fahrzeugen mit NVIDIA DRIVE über Gesundheitslösungen mit NVIDIA Clara bis hin zu AI-gestützten Analysen und Workflows.
• Leitung der Bemühungen zur betrieblichen Einsatzbereitschaft am zweiten Betriebstag (Day 2) für NVIDIA Cloud Partner. • Zusammenarbeit mit NVIDIA Cloud Partnern zur Einrichtung von Systemen, Verfahren, Automatisierung und Betriebsmethoden für die Verwaltung der NVIDIA-beschleunigten Infrastruktur nach deren Bereitstellung und Aktivierung. • Entwicklung kontinuierlicher Validierungsmethoden für den Zustand von GPU, CPU, Speicher und Netzwerk in groß angelegten KI-Clustern. • Einrichtung von Telemetrie, Monitoring, Alarmierung, Dashboards und betrieblichen Signalen für Compute, GPU, InfiniBand-/RoCE-Netzwerke, Speicher, Kubernetes und KI-Workloads. • Entwicklung automatisierter Workflows zur Erkennung, Isolierung, Entleerung, Reparatur und Validierung fehlerhafter Infrastruktur sowie zu deren Rückführung in den Betrieb. • Umsetzung skalierbarer Strategien für den Lebenszyklus von GPU-Flotten, einschließlich Treiber- und Firmware-Verwaltung, Wartung von Kubernetes-Nodes, Betriebssystem-Patching, Konfigurationsmanagement, Upgrades und Erkennung von Konfigurationsabweichungen. • Überführung der Anforderungen und Referenzarchitekturen von NVIDIA Cloud Partnern in Produktionspraktiken, Validierungskriterien, Runbooks, Automatisierung und messbare Betriebsstandards. • Entwicklung von Zustandsindikatoren, SLOs, Metriken, Abnahmekriterien und laufenden Validierungsmechanismen für Infrastrukturzuverlässigkeit und Servicebereitschaft. • Entwicklung wiederverwendbarer Tools, Automatisierungen, Implementierungsleitfäden, Runbooks, Betriebs-Playbooks und Referenzimplementierungen für mehrere NVIDIA-Cloud-Partner-Umgebungen.
• Bachelor-, Master- oder Promotionsabschluss in Informatik, Computertechnik, Elektrotechnik oder einem verwandten technischen Fachgebiet oder eine gleichwertige Qualifikation durch Berufserfahrung. • Mindestens 8 Jahre Erfahrung in den Bereichen Infrastruktur-Engineering, Site Reliability Engineering, DevOps, Cloud-Plattform-Engineering, Systems Engineering oder vergleichbaren Rollen mit Verantwortung für groß angelegte Produktionsumgebungen. • Fundierte Erfahrung im produktiven Betrieb verteilter Linux-basierter Systeme und Cloud-Infrastrukturen. • Tiefgreifendes Verständnis von Kubernetes, Containern, Cluster-Scheduling und dem betrieblichen Lebenszyklus großer Umgebungen mit vielen Nodes. • Sehr gutes Verständnis von Observability in Produktionsumgebungen, einschließlich Metriken, Logging, Alarmierung, Dashboards, Zustandsprüfungen und SLA-orientiertem Betrieb. • Erfahrung in der Entwicklung von Automatisierungen für das Infrastruktur-Lebenszyklusmanagement, die Fehlererkennung, Fehlerbehebung, Upgrades und das Konfigurationsmanagement. • Fundierte Netzwerkkenntnisse und Erfahrung bei der Fehleranalyse komplexer verteilter Systeme über die Ebenen Compute, Netzwerk und Speicher hinweg. • Erfahrung in Programmierung und Automatisierung mit Python, Go, Shell-Scripting oder vergleichbaren Sprachen. • Erfahrung in der Verwaltung umfangreicher GPU- oder beschleunigter Computing-Infrastrukturen zur Unterstützung von KI-Trainings- und Inferenz-Workloads. • Erfahrung mit NVIDIA-Technologien, darunter DGX-/HGX-Systeme, CUDA, NVLink/NVSwitch, NVIDIA-Netzwerke, InfiniBand, RoCE, GPU Operator, Network Operator oder vergleichbare NVIDIA-Infrastruktur-Software. • Nachweisliche Erfahrung in der Zusammenarbeit mit NVIDIA Cloud Partnern, Hyperscale-Cloud-Anbietern, Managed-AI-Clouds oder umfangreichen Service-Provider-Infrastrukturen sowie im Betrieb von SLOs für groß angelegte Compute-Infrastrukturen und in der Nutzung von Betriebsdaten zur Verbesserung von Verfügbarkeit, Leistung und Flotteneffizienz. • Umfassende Kenntnisse von Observability-Tools für Infrastrukturen, darunter Prometheus, Grafana, OpenTelemetry, Alertmanager und skalierbare Telemetrie-Pipelines. • Kenntnisse der Fehlerszenarien großer verteilter KI-Workloads und der erforderlichen Infrastrukturmerkmale zur zuverlässigen Unterstützung lang laufender Trainings- und produktiver Inferenz-Workloads.
Jetzt Bewerben🕒 vor 1 Tag
C#/.NET-Backendentwickler für SMART COMPARE, den digitalen Versicherungstarif-Vergleichsrechner von Smart InsurTech. Entwicklung skalierbarer Microservices und KI-gestützter Automatisierungen.
🕒 vor 1 Tag
Softwarearchitekt für die Entwicklung skalierbarer Plattformen für MCP, Node.js und KI-Orchestrierung. Etablierung unternehmensweiter Architekturstandards und wiederverwendbarer Integrationen für ein europäisches FinTech-Unternehmen.
🗣️🇺🇸🇬🇧 Englisch erforderlich
🕒 vor 1 Tag
KI-Softwarearchitekt für die Entwicklung skalierbarer MCP-Plattformen, SDKs und Funktionen zur KI-Orchestrierung. Mitgestaltung von Architekturstandards für einen europäischen Anbieter von FinTech-Infrastruktur.
🗣️🇺🇸🇬🇧 Englisch erforderlich
🕒 vor 2 Tagen
Senior Full-Stack-Entwickler für Java- und Angular-Projekte bei Rockstardevelopers, einem deutschen Softwareentwickler. Entwicklung in Enterprise- und regulierten Kundenumgebungen mit modernen KI-Tools.
🕒 vor 2 Tagen
Tech Lead für die Java/Spring-Boot-Ratenkreditplattform bei Europace, Deutschlands FinTech-Transaktionsplattform. Verantwortung für Architektur, Delivery, Betrieb und technische Führung.