
51 - 200 Mitarbeiter
Gegründet 2015
🔧 Hardware
⚡ Energie
🤝 B2B
Hardware • Energy • B2B
Submer ist ein Anbieter von vernetzter Intelligenz für KI-Infrastrukturen und spezialisiert sich auf fortschrittliche Flüssigkeits-/Tauchkühlung und modulare Rechenzentrumslösungen. Sie entwerfen, bauen und betreiben KI-fähige Umgebungen (von Energie und Land bis hin zu Cloud und Edge), stellen Tauchkühlungspods (SmartPod EVO/EXO) her und bieten GPUaaS/AIaaS sowie modulare Bereitstellungsdienste an. Submer legt Wert auf Energie- und Wassereinsparungen, hochdichte thermische Architekturen für anspruchsvolle KI-Workloads und souveränitätsgerechte, global einsetzbare Lösungen.
🔥 vor 32 Minuten
🗣️🇺🇸🇬🇧 Englisch erforderlich
Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

51 - 200 Mitarbeiter
Gegründet 2015
🔧 Hardware
⚡ Energie
🤝 B2B
Hardware • Energy • B2B
Submer ist ein Anbieter von vernetzter Intelligenz für KI-Infrastrukturen und spezialisiert sich auf fortschrittliche Flüssigkeits-/Tauchkühlung und modulare Rechenzentrumslösungen. Sie entwerfen, bauen und betreiben KI-fähige Umgebungen (von Energie und Land bis hin zu Cloud und Edge), stellen Tauchkühlungspods (SmartPod EVO/EXO) her und bieten GPUaaS/AIaaS sowie modulare Bereitstellungsdienste an. Submer legt Wert auf Energie- und Wassereinsparungen, hochdichte thermische Architekturen für anspruchsvolle KI-Workloads und souveränitätsgerechte, global einsetzbare Lösungen.
• Entwurf, Implementierung und Betrieb der Netzwerkinfrastruktur für eine GPU-Cloud-Plattform für Cloud-Gaming-, KI- und Machine-Learning-Anwendungen in Telekommunikationsnetzen • Entwurf und Betrieb leistungsstarker GPU-Netzwerk-Fabrics und großskaliger RoCE-Fabrics • Optimierung der Netzwerkleistung für GPU-Kommunikationsmuster und East-West-Datenverkehr • Definition wiederverwendbarer Referenzarchitekturen und Designprinzipien für AI-Fabrics • Entwurf und Betrieb von Layer-2- und Layer-3-Rechenzentrumsnetzwerken mit skalierbaren Routing-Architekturen • Sicherstellung der Mandantenisolierung sowie Verwaltung von Ingress-/Egress-Routing, Datenverkehr und Overlay-Networking • Bereitstellung und Wartung der North-South-Sicherheitsinfrastruktur, von WAF-Schutzmechanismen und Plattform-Sicherheitskontrollen • Entwurf privater Interconnects, Dark-Fiber-Ringe, hochkapazitativer WAN-Anbindungen und der Integration in globale Backbone-Netzwerke • Leitung der vollständigen technischen Umsetzung – vom Design und der Validierung im Labor bis zur Bereitstellung in der Produktion • Prüfung von Netzwerk-Stücklisten, Mitwirkung an Rechenzentrumslayouts und Rack-Aufrissen sowie Steuerung der Kapazitätsplanung • Etablierung von Bereitstellungsstandards, Validierungskriterien, Rollback-Strategien und wiederverwendbaren Abnahmemustern • Verantwortung für die betriebliche Leistung und Zuverlässigkeit der Netzwerke • Automatisierung von Provisionierung, Konfigurationsmanagement, Monitoring und Lifecycle-Management • Leitung der Incident Response und Ursachenanalyse bei schwerwiegenden Netzwerkereignissen • Definition und Nachverfolgung von SLAs, SLOs, Zuverlässigkeitskennzahlen und betrieblichen Benchmarks • Zusammenarbeit mit den Teams für Infrastruktur, Plattform, SRE, Compute, Storage, Observability und Rechenzentrumsbetrieb • Tätigkeit als zentrale Instanz für Netzwerkdesign sowie maßgebliche Mitgestaltung der Networking-Roadmap der Plattform • Mentoring von Engineers und Unterstützung beim Aufbau des Networking-Bereichs
• Umfassende praktische Erfahrung im Design und Betrieb großskaliger Rechenzentrumsnetzwerke • Expertenkenntnisse in BGP, OSPF, ECMP und EVPN/VXLAN • Nachgewiesene Erfahrung im Betrieb von Hochgeschwindigkeits-Ethernet-Netzwerken in Produktionsumgebungen • Erfahrung im Betrieb von NVIDIA-/Mellanox-Netzwerkplattformen • Tiefgreifende Expertise im Design und Betrieb von Netzwerk-Fabrics für großskalige GPU-Cluster und verteilte AI-Workloads • Tiefes Verständnis der NCCL-Kommunikationsmuster • Erfahrung bei der Optimierung von RoCE-Fabrics • Sehr gute Kenntnisse des RDMA-Transportverhaltens und seiner Fehlerbilder • Praktische Erfahrung mit der Implementierung und Optimierung von PFC und ECN • Verständnis der Kommunikationsmuster von GPU-Kollektiven • Erfahrung im Design rail-optimierter GPU-Netzwerk-Fabrics • Verständnis der Auswirkungen der Netzwerkleistung auf PyTorch und TensorFlow • Fähigkeit zur Analyse von Problemen über mehrere Ebenen hinweg, einschließlich Hardware, Firmware, Kernel-Networking und Kommunikationsschichten verteilter Anwendungen • Sehr gute Kenntnisse in Netzwerkausrüstung, Optik und Hochgeschwindigkeits-Interconnects • Erfahrung im Design von Systemen zur Netzwerk-Observability • Ausgeprägte Automatisierungskenntnisse mit Python und/oder Bash • Erfahrung mit der Anwendung von Software-Engineering-Praktiken auf die Infrastrukturautomatisierung • Nachgewiesene Fähigkeit, komplexe technische Initiativen teamübergreifend zu leiten • Nachgewiesene Fähigkeit, architektonische Leitlinien festzulegen und die Einführung technischer Standards voranzutreiben • Ausgeprägte Mentoring-Fähigkeiten • Erfahrung in der Verantwortung für Architektur und direkter Umsetzung in schlanken oder schnell wachsenden Umgebungen ist ausdrücklich von Vorteil
• Attraktives Vergütungspaket entsprechend Ihrer Expertise und Erfahrung • Flexibles Arbeitsumfeld • Für hybrides Arbeiten geeignete Arbeitsweise • Internationales und vielfältiges Arbeitsumfeld • Entwicklungsmöglichkeiten in einem schnell wachsenden Scale-up
Jetzt Bewerben🕒 vor 6 Tagen
Cloud-KI-Engineer zur Entwicklung agentischer KI-Workflows und cloudbasierter Machine-Learning-Lösungen. Einsatz von Vertex AI, MLOps und generativer KI für IT-Kunden in ganz Europa.
🇪🇺 Europa – Remote
💰 €108.000.000 Post-IPO Equity - Virtusa im 2017-05
⏰ Vollzeit
🟠 Senior
🔴 Experte
🤖 KI-Ingenieur
🗣️🇺🇸🇬🇧 Englisch erforderlich
🕒 vor 1 Monat
Staff Software Engineer, der KI-Systeme für Governance bei Wand entwickelt. Analysiert Organisationsdaten und erstellt agentenbasierte Workflows mit hoher Autonomie.
🗣️🇺🇸🇬🇧 Englisch erforderlich
Neo4j