DevOps- und IT-Support Engineer

Stelle nicht auf LinkedIn

🔥 vor 23 Minuten

🌏 Überall auf der Welt

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung überprüfen.

Logo of Ayrin Digital

Ayrin Digital

11 - 50 Mitarbeiter

Gegründet 2025

🤖 Künstliche Intelligenz

☁️ SaaS

🤝 B2B

Artificial Intelligence • SaaS • B2B

Ayrin Digital ist ein AI-natives Softwareunternehmen, das Unternehmen dabei hilft, sich zu transformieren, indem es praxisnahe, verantwortungsvolle und AI-zentrierte Systeme entwickelt, die sie selbst besitzen und steuern. Sie positionieren sich als Architekten und Erbauer, die Daten vereinfachen, anfällige Drittanbieter-SaaS-Abhängigkeiten ersetzen und messbare, stakeholderorientierte Ergebnisse liefern – mit einem schnellen ROI und skalierbaren Architekturen, die von wenigen Nutzern auf Millionen wachsen können. Ihre Botschaft betont Transparenz (keine Black-Box-KI), Verantwortlichkeit, die an Geschäftskriterien gebunden ist, und die Bereitstellung produktionsreifer AI-Lösungen für Unternehmensanforderungen.

Beschreibung

• Verantwortlich für die Bereitstellung, Konfiguration und Verwaltung von Multi-Cloud-Umgebungen in AWS, Azure und GCP und Auswahl der passenden Services je nach Projektanforderungen. • Entwurf und Pflege von Infrastructure-as-Code-Modulen mit Terraform, Pulumi, CDK oder CloudFormation — dabei Sicherstellung, dass alle Infrastrukturen versioniert, reproduzierbar und peer-reviewed sind. • Architektur und Verwaltung der Container-Orchestrierung mit Docker und Kubernetes, einschließlich Cluster-Provisioning, Skalierungsrichtlinien und Ressourcenoptimierung. • Implementierung von Best Practices in Netzwerk, Sicherheit und Compliance über alle Umgebungen hinweg — VPCs, IAM-Richtlinien, Secrets-Management, Verschlüsselung im Ruhezustand und während der Übertragung. • Vorantreiben von Kostenoptimierungsmaßnahmen durch Überwachung der Cloud-Ausgaben, Right-Sizing der Ressourcen und Einsatz von Reserved-/Spot-Instance-Strategien. • Aufbau und Pflege von CI/CD-Pipelines mit GitHub Actions, Jenkins oder GitLab CI — Automatisierung von Build-, Test- und Deployment-Workflows in mehreren Umgebungen (Entwicklung, Staging, Produktion). • Implementierung von GitOps-Praktiken und progressiven Deployment-Strategien (Blue-Green, Canary, Rolling Updates) zur Minimierung von Release-Risiken. • Automatisierung operativer Aufgaben — Infrastruktur-Provisioning, Einrichtung von Umgebungen, Logrotation, Zertifikatsverlängerung, Backup und Restore — zur Reduzierung manueller Tätigkeiten. • Gewährleistung der Umgebungskonsistenz zwischen Entwicklung, Staging und Produktion, um konsistente und zuverlässige Deployments sicherzustellen. • Einrichtung und Pflege von Observability-Stacks mit Prometheus, Grafana, ELK, Datadog oder vergleichbaren Tools — Abdeckung von Metriken, Logs, Traces und Alerting. • Definition und Überwachung von SLOs und SLIs für kritische Dienste und Ableitung von Zuverlässigkeitsverbesserungen auf Basis von Daten. • Leitung des Incident Response — Triage von Produktionsproblemen, Koordination der Problemlösung, Durchführung von „blameless“ Post-Mortems und Implementierung präventiver Maßnahmen. • Durchführung regelmäßiger Sicherheitsaudits, Vulnerability-Scans und Patch-Management für Infrastruktur und Services. • Verwaltung des Mitarbeiter-On- und Offboardings — Provisioning und Deprovisioning von Accounts in Google Workspace, Slack, GitHub, Notion, Linear und anderen internen Tools. • Administration von Identity- und Access-Management mit Okta, Azure AD/Entra ID oder Google Workspace Admin — Verwaltung von SSO, MFA, RBAC und Access Reviews. • Pflege der VPN-Infrastruktur und der Netzwerkzugriffsrichtlinien für die Remote-Belegschaft. • Dokumentation von IT-Prozessen, Pflege von Runbooks und Erstellung von Self-Service-Anleitungen zur Reduzierung wiederkehrender Support-Anfragen. • Unterstützung der Kundenteams bei Deployment-Problemen, Provisionierung von Umgebungen und Infrastrukturübergaben. • Fehlerbehebung bei kundenrelevanten Umgebungssproblemen — Netzwerkprobleme, Zugriffskonfiguration, Service-Konnektivität und Deployment-Fehler. • Zusammenarbeit mit Projektleitern zum Entwurf und Aufbau projektspezifischer Infrastruktur entsprechend den Projektanforderungen und Sicherheitsstandards. • Klare, zeitnahe Kommunikation gegenüber internen und externen Stakeholdern während Incidents und Infrastrukturänderungen.

🎯 Anforderungen

• Mindestens 4 Jahre praktische Erfahrung in DevOps, Site Reliability Engineering oder in Cloud-Infrastruktur-Rollen. • Sehr gute Kenntnisse in mindestens zwei der drei großen Cloud-Plattformen (AWS, Azure, GCP) und praktische Vertrautheit mit der dritten. • Produktionserfahrung mit Infrastructure-as-Code-Tools — mindestens eines der folgenden: Terraform, Pulumi, AWS CDK oder CloudFormation. • Fundierte Erfahrung mit Containerisierung (Docker) und Container-Orchestrierung (Kubernetes) in Produktionsumgebungen. • Praktische Erfahrung im Aufbau und der Pflege von CI/CD-Pipelines mit GitHub Actions, Jenkins, GitLab CI oder ähnlichen Tools. • Starke Linux-Systemadministrationskenntnisse und sichere Scripting-Fähigkeiten (Bash, Python oder PowerShell). • Erfahrung mit Monitoring- und Observability-Tools — Prometheus, Grafana, ELK Stack, Datadog oder Äquivalente. • Fundierte Kenntnisse der Netzwerktechnik — DNS, TCP/IP, Load Balancing, VPN, Firewalls und SSL/TLS. • Erfahrung in der Verwaltung von Identity- und Access-Management — SSO, SAML, OIDC, RBAC und MFA mit Plattformen wie Okta, Azure AD oder Google Workspace Admin. • Nachgewiesene Erfahrung in der IT-Administration — On- und Offboarding von Mitarbeitenden sowie Zugriffsprovisionierung. • Ausgeprägte Troubleshooting-Fähigkeiten mit methodischem Ansatz zur Diagnose von Infrastruktur- und Deployment-Problemen. • Hervorragende Kommunikationsfähigkeiten — Fähigkeit, technische Sachverhalte klar sowohl gegenüber Ingenieur:innen als auch nicht-technischen Stakeholdern zu vermitteln.

🏖️ Vorteile

• Wettbewerbsfähiges Gehalt • Flexible Arbeitszeiten • Budget für berufliche Weiterbildung • Zuschuss für Home-Office-Ausstattung • Globale Team-Events

Jetzt Bewerben

Ähnliche Jobs

🔥 vor 1 Stunde

Supabase

51 - 200

☁️ SaaS

🔌 API

🤖 Künstliche Intelligenz

Release Engineer bei Supabase, verantwortlich für sichere, beobachtbare Deployments und operative Zuverlässigkeit über die Systeme hinweg. Mitarbeit im Incident‑Management, Monitoring und in der Prozessdokumentation zur Steigerung der Deployment‑Effizienz.

🌏 Überall auf der Welt

💰 €80.000.000 Series B im 2022-05

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 6 Tagen

Social Discovery Group

1001 - 5000

🌍 Soziale Wirkung

📱 Medien

DevOps Engineer, der interne Dienste und Tools in Go für Produkte im Bereich Social Discovery entwickelt. Zusammenarbeit an der Deployment-Automatisierung in einer Remote-Arbeitsumgebung mit einem globalen Team.

🌏 Überall auf der Welt

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇷🇺 Russisch erforderlich

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 16 Tagen

GitLab

1001 - 5000

💼 Beratung

📣 Marketing

🤖 Künstliche Intelligenz

Site Reliability Engineer, der die Zuverlässigkeit der für Endnutzer sichtbaren GitLab-Dienste sicherstellt. Unterstützung der operativen Exzellenz durch ingenieurwissenschaftliche Prinzipien und Automatisierung.

🌏 Überall auf der Welt

💵 $126.400 - $314.400 / Jahr

💰 Secondary Market im 2020-11

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 17 Tagen

Growe Talents

11 - 50

💼 Beratung

📣 Marketing

🎯 Rekrutierung

DevSecOps-Rolle zum Aufbau und zur eigenverantwortlichen Leitung der Sicherheitsfunktion bei Growe Talents, Bewertung der Sicherheitslage und Implementierung von Kontrollen über den gesamten Entwicklungslebenszyklus.

🌏 Überall auf der Welt

⏰ Vollzeit

🟢 Junior

🟡 Mittelstufe

⛑ DevOps- und Site Reliability Engineer (SRE)

🚫👨‍🎓 Kein Abschluss erforderlich

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 18 Tagen

Onchain

51 - 200

💸 Finanzen

💳 Fintech

₿ Crypto

DevOps-Ingenieur, der die Cloud-Infrastruktur hinter der Finanzplattform von Lisk beim Skalieren weiterentwickelt. Tritt einem Remote-first-Team bei, um Sicherheit und Zuverlässigkeit von geldverarbeitenden Systemen zu verbessern.

🌏 Überall auf der Welt

💰 Series B im 2018-07

⏰ Vollzeit

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

🗣️🇺🇸🇬🇧 Englisch erforderlich