Senior Platform Operations Engineer / Site Reliability Engineer (m/w/d)

Stelle nicht auf LinkedIn

🔥 vor 38 Minuten

🇩🇪 Deutschland – Remote

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

👻 Geisterscore 12%

infoinfo

🗣️🇺🇸🇬🇧 Englisch erforderlich

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of Netlution GmbH

Netlution GmbH

201 - 500 Mitarbeiter

Gegründet 2001

💼 Beratung

🏢 Unternehmen

🤖 Künstliche Intelligenz

Consulting • Enterprise • Artificial Intelligence

Die Netlution GmbH ist ein deutsches IT-Beratungs- und Dienstleistungsunternehmen, das sich auf Enterprise Service Management und IT-Infrastruktur spezialisiert hat. Sie bieten maßgeschneiderte IT- und Anwendungsdienstleistungen an – insbesondere im Umfeld von ServiceNow – und decken dabei Service Operations, KI-unterstützte ServiceNow-Integrationen, DevOps, Cloud- und Application Engineering, Third-Level-Support und Transition-/EOL-Services für mittelständische und große Unternehmen ab. Netlution positioniert sich als vertrauenswürdiger Berater, der Vor-Ort- und Remote-Expertenteams bietet, die sich auf Automatisierung, hochwertige Betriebsführung und geschäftsorientierte IT-Lösungen konzentrieren.

Beschreibung

• Betrieb, Betreuung und Weiterentwicklung von Monitoring- und Observability-Plattformen • Administration und Optimierung von Prometheus, Grafana sowie OpenSearch / ELK • Überwachung produktiver Systemlandschaften und kontinuierliche Verbesserung von Monitoring- und Alerting-Konzepten • Bearbeitung von Incidents sowie Unterstützung bei der Wiederherstellung kritischer Services • Durchführung von Root Cause Analysen und nachhaltige Beseitigung von Störungsursachen • Unterstützung bei Major Incidents und Koordination technischer Lösungsmaßnahmen • Betrieb und Optimierung containerisierter Plattformen auf Basis von Kubernetes • Unterstützung von CI/CD-Prozessen mit Jenkins und ArgoCD • Erstellung, Pflege und Weiterentwicklung von Runbooks, Betriebsprozessen und technischer Dokumentation • Automatisierung wiederkehrender Betriebsaufgaben • Teilnahme an Rufbereitschaften und Schichtmodellen in einer 24x7-Betriebsorganisation

🎯 Anforderungen

• Mehrjährige Erfahrung im Bereich Platform Operations, Site Reliability Engineering, System Engineering oder IT Operations • Bereitschaft zur Durchführung bzw. Vorliegen einer Sicherheitsüberprüfung SÜ2 • Sehr gute Kenntnisse in Linux-basierten Umgebungen • Verständnis für Kubernetes und containerisierte Plattformen • Praxiserfahrung mit Prometheus • Praxiserfahrung mit Grafana • Praxiserfahrung mit ELK Stack oder OpenSearch • Praxiserfahrung mit Elasticsearch oder OpenSearch • Erfahrung im Monitoring, Alerting und Observability-Umfeld • Gute Kenntnisse von Netzwerkgrundlagen und Kommunikationsprotokollen • Erfahrung im Umgang mit REST APIs • Sicherer Umgang mit Git • Analytische Herangehensweise bei Fehleranalysen und Störungsbehebung • Gute Englischkenntnisse in Wort und Schrift • Bereitschaft zur Teilnahme an Rufbereitschaften und Schichtbetrieb • Nice-to-have: Erfahrung mit ArgoCD • Nice-to-have: Kenntnisse in Jenkins • Nice-to-have: Erfahrung mit Helm • Nice-to-have: Bash-Scripting • Nice-to-have: Python für Betriebsautomation und Operational Excellence • Nice-to-have: Erfahrung im Bereich Site Reliability Engineering (SRE) • Nice-to-have: Kenntnisse moderner Cloud- oder Plattformarchitekturen

🏖️ Vorteile

• Unbefristeter Arbeitsvertrag • Attraktive Vergütung • Weiterbildungen • Hybrid und Full Remote Modell • PC Ausstattung

Jetzt Bewerben

Ähnliche Jobs

🔥 vor 38 Minuten

coeo Group

501 - 1000

💳 Fintech

🤝 B2B

🤖 Künstliche Intelligenz

Azure Cloud Operations Engineer (m/w/d) für coeo, den datengetriebenen Spezialisten im Forderungsmanagement. Betrieb, Automatisierung und Weiterentwicklung von Azure- und Windows-Server-Infrastrukturen.

🇩🇪 Deutschland – Remote

💵 €60.000 - €70.000 / Jahr

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 1 Tag

adorsys

51 - 200

💳 Fintech

🔌 API

🔒 Cybersecurity

DevOps Engineer bei adorsys, einem Nürnberger Technologieunternehmen für Software-, Cloud- und Architekturlösungen. Automatisierung von Infrastruktur, CI/CD und Kubernetes-Deployments für Kundenumgebungen.

🕒 vor 2 Tagen

Sigma Software Group

1001 - 5000

💼 Beratung

🏥 Gesundheitswesen

🚘 Automobilindustrie

Forward AI-Deployment Engineer zur Neugestaltung der Kundenabläufe mit KI im Produktivbetrieb bei Sigma Software. Entwicklung agentenbasierter Systeme, von RAG- und Datenpipelines für nachhaltige Verbesserungen von Arbeitsabläufen.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 3 Tagen

Interlead GmbH

51 - 200

🛡️ Versicherung

📦 Logistik

🏥 Gesundheitswesen

DevSecOps Engineer für die Absicherung von Servern, Cloud-Infrastruktur und CI/CD-Pipelines der Plattform von Interlead für qualifizierte Leads. Automatisierung von Betriebsabläufen und Verankerung von Sicherheit im gesamten Technologie-Stack.

🕒 vor 5 Tagen

IT42morrow IFT GmbH

1 - 10

💼 Beratung

📦 Logistik

📣 Marketing

DevOps Engineer für die Betreuung von Cloud-Umgebungen, CI/CD-Pipelines, Automatisierung und Sicherheit. Unterstützung vielfältiger Kundenprojekte für das deutsche IT-Beratungsunternehmen IT42morrow.

🇩🇪 Deutschland – Remote

💵 €45.000 - €75.000 / Jahr

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)