DevOps Engineer (KI-Inferenz)

🔥 vor 38 Minuten

🌐 Zypern, Polen, +3 weitere Länder – Remote

infoinfo

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

👻 Geisterscore 10%

infoinfo

🗣️🇺🇸🇬🇧 Englisch erforderlich

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of Gcore

Gcore

201 - 500 Mitarbeiter

💼 Beratung

📦 Logistik

📣 Marketing

Consulting • Logistics • Marketing

Gcore ist ein globaler Anbieter von Cloud-, Edge- und KI-Lösungen, die das KI-Training beschleunigen, umfassende Cloud-Dienstleistungen liefern, die Inhaltsbereitstellung verbessern und Server und Anwendungen schützen. Mit über 180 Standorten weltweit und einer Netzwerk-Kapazität von über 200 Tbps bietet Gcore sichere, flexible und skalierbare Infrastrukturdienste. Die integrierten Angebote, darunter Edge Cloud, Edge Network, Edge Security und AI Infrastructure, sind darauf ausgelegt, die Bedürfnisse von Unternehmen zu erfüllen, die ihre globale Infrastruktur effizient skalieren und steuern möchten. Gcore bietet zudem starken DDoS-Schutz und Origin-Shielding, um einen reibungslosen Online-Betrieb zu gewährleisten, was das Unternehmen zu einem vertrauenswürdigen Partner für Tausende von Unternehmen weltweit macht.

Beschreibung

• Entwurf, Entwicklung und Wartung der Infrastruktur für KI-Inferenz-Workloads, einschließlich GPU-Scheduling, Model-Deployment-Pipelines und Datenzugriffsmustern in On-Premises-Umgebungen • Aufbau und Betrieb von Monitoring- und Observability-Tools für KI-Inferenz-Plattformen, einschließlich Dashboards, Alerts und Runbooks zur Überwachung der Modellgesundheit und der Systemleistung • Zusammenarbeit mit ML-Engineers und Plattform-Teams zur Auslegung der Systemarchitektur für KI-Workloads • Integration von Inference-Runtimes • Testen der KI-Inferenz-Performance im großen Maßstab

🎯 Anforderungen

• Diese Stelle ist nur im Rahmen eines Arbeitsvertrags verfügbar • Fundiertes Verständnis der Kubernetes-Architektur, einschließlich CNI, CSI, Operators, Ingress/Gateway und Control-Plane-Komponenten • Praktische Erfahrung im Betrieb und Troubleshooting von produktiven Kubernetes-Clustern • Fundierte Linux- und Netzwerk-Troubleshooting-Fähigkeiten, einschließlich DNS, Routing, Firewalling, TLS, MTU sowie Konnektivitäts- und Leistungsproblemen • Fähigkeit zur Entwicklung von Automatisierungs- und Betriebstools mit Python, Go oder Bash • Erfahrung mit Terraform, Ansible oder ähnlichen IaC-/Konfigurationsmanagement-Tools • Erfahrung mit VictoriaMetrics/Grafana oder ähnlichen Monitoring-, Alerting- und Troubleshooting-Tools • Umfangreiche Erfahrung mit Git-basierten Workflows und CI/CD-Pipelines • Vertrautheit mit Cluster API oder ähnlichen Technologien für das Kubernetes-Cluster-Lifecycle-Management • Praktische Erfahrung im Betrieb oder in der Administration von Slurm-Clustern • Kenntnisse in Argo CD, GitOps-Workflows, Helm oder Helmfile • Erfahrung mit Managed-Plattformen, PaaS oder Cloud-Services • Erfahrung mit Bare-Metal-, GPU-, HPC- oder anderen Hochleistungsrechenumgebungen • Vertrautheit mit dem NVIDIA-GPU-Stack, RDMA/InfiniBand oder Hochleistungsnetzwerken • Kenntnisse in OpenStack oder ähnlichen Cloud-Infrastrukturplattformen • Praktische Erfahrung in der Entwicklung von Kubernetes-Operators oder -Controllern

🏖️ Vorteile

• Wettbewerbsfähige Vergütung • Flexible Arbeitszeiten und hybride oder Remote-Arbeitsmöglichkeiten, je nach Rolle • Arbeiten von überall auf der Welt für bis zu 45 Tage pro Jahr • Private Krankenversicherung für Sie und Ihre Familie* • Zusätzliche bezahlte Urlaubs- und Krankheitstage* • Unterstützung bei wichtigen Lebensereignissen und Feierlichkeiten • Sprachkurse zur persönlichen und beruflichen Weiterentwicklung • Moderne, einladende Büros mit Snacks, Getränken und Unterhaltung* • Teamsport und soziale Aktivitäten*

Jetzt Bewerben

Ähnliche Jobs

🕒 vor 1 Tag

Vivid Money

201 - 500

💳 Fintech

🏦 Bankwesen

💸 Finanzen

DevSecOps Engineer securing AWS, Kubernetes, and AI infrastructure at Vivid, a fintech platform serving businesses and individuals across Europe. Improving cloud, application, and vulnerability security.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 1 Tag

Vivid Money

201 - 500

💳 Fintech

🏦 Bankwesen

💸 Finanzen

DevSecOps Engineer securing AWS, Kubernetes, and AI infrastructure for Vivid, a European fintech platform. Improving cloud security, vulnerability management, and AI-aware controls across engineering systems.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 28 Tagen

Fundraise Up

51 - 200

🤲 Wohltätigkeit

💳 Fintech

☁️ SaaS

DevOps Engineer managing observability and CI/CD for Fundraise Up, a global fundraising platform. Driving technical initiatives and mentoring less experienced engineers in a complex product ecosystem.

🇨🇾 Zypern – Remote

💵 €5.800 - €6.600 / Monat

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇷🇺 Russisch erforderlich

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 1 Monat

Aylo

1001 - 5000

👥 B2C

🎮 Gaming

Sr DevOps in high traffic environment supporting production and development infrastructure for diverse teams. Collaborating on architecture improvements and optimizing workflows with modern tools.

🇨🇾 Zypern – Remote

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich