Site Reliability Engineer (m/f/d)

🕒 vor 5 Monaten

🇩🇪 Deutschland – Remote

💵 €50.000 - €70.000 / Jahr

⏰ Vollzeit

🟡 Mittelstufe

🟠 Senior

⛑ DevOps- und Site Reliability Engineer (SRE)

👻 Geisterscore 54%

infoinfo
Jetzt Bewerben
Ähnliche Remote-Jobs finden

📊 Überprüfen Sie Ihre Lebenslauf-Bewertung für diese Stelle

Verbessern Sie Ihre Chancen auf ein Vorstellungsgespräch, indem Sie Ihre Lebenslauf-Bewertung vor der Bewerbung ßberprßfen.

Logo of Deepslate

Deepslate

11 - 50 Mitarbeiter

💼 Beratung

🏥 Gesundheitswesen

🛡️ Versicherung

Consulting • Healthcare • Insurance

Deepslate ist ein auf Europa fokussiertes Sprach-zu-Sprach-Voice-AI-Unternehmen, das ultraflexible, DSGVO-konforme Sprachdialog-Agenten für Unternehmenskunden bietet. Das Unternehmen bietet eine produktionsbereite Infrastruktur mit Optionen für Self-Hosting oder EU-Cloud, geringe End-to-End-Latenz (≈250–400 ms), mehrsprachige Unterstützung in über 27 Sprachen und fortschrittliches kontextbezogenes Denken für reale Kundeninteraktionen. Deepslate zielt auf Branchen wie Banken, Versicherungen, Einzelhandel und Gesundheitswesen ab, um hochvolumige Kundenkonversationen zu automatisieren und gleichzeitig den Fokus auf Datenschutz und kosteneffiziente Skalierung zu legen.

Beschreibung

• Your mission is to build an infrastructure so resilient that potential outages are caught and mitigated before they even happen. • Design, build, and manage our cloud infrastructure using modern tools (Pulumi). • Orchestrate and optimize our Kubernetes clusters for complex, compute-heavy AI workloads. • Implement a flawless monitoring setup using Datadog and OpenTelemetry. • Establish and manage our on-call and alerting processes (using PagerDuty) and champion a culture of blameless post-mortems. • Build and maintain highly automated Integration Testing and deployment pipelines. • Define and monitor our service-level metrics, turning reliability into a measurable core component of our product development cycle. • Ruthlessly automate away toil to allow the engineering team to focus on innovation instead of maintenance. • Ensure our infrastructure is not only highly available but also secured against external threats.

🎯 Anforderungen

• Kubernetes: Deep, hands-on experience in setting up, managing, and scaling self-hosted Kubernetes clusters in production. • Infrastructure as Code: Strong experience with modern IaC, ideally with Pulumi (or deep Terraform knowledge alongside a willingness to adopt Pulumi). • Observability: You are a pro with Datadog and OpenTelemetry. • Alerting & Incident Management: Proven experience with PagerDuty (or similar tools). • Integration Testing & CI/CD: Hands-on experience setting up robust testing and deployment pipelines. • Fluent German skills: (spoken and written). • Startup Mindset: You are comfortable navigating the chaos of an early-stage codebase. • Extreme Ownership: You aren't just looking to blindly process Jira tickets.

🏖️ Vorteile

• Health insurance • Professional development

Jetzt Bewerben

Ähnliche Jobs

🕒 vor 5 Monaten

Reflow

11 - 50

☁️ SaaS

🏢 Unternehmen

🤝 B2B

DevOps- und Security-Engineer, der die Cloud-Infrastruktur von Reflow weiterentwickelt und die Sicherheitslage einer Workflow-Intelligence-Plattform stärkt.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 5 Monaten

KLAR-GRUPPE

1 - 10

💼 Beratung

🎯 Rekrutierung

🤝 B2B

DevOps Engineer, der stabile IT-Systeme fĂźr ein Gesundheitsunternehmen entwirft und automatisiert. Verantwortlich fĂźr CI/CD-Pipelines und technischen Support im Kundenkontakt.

🕒 vor 5 Monaten

virtual7 GmbH

51 - 200

💼 Beratung

🏥 Gesundheitswesen

📦 Logistik

Senior NixOS / DevOps Engineer, der Kund:innen bei modernen, automatisierten Software‑ und Infrastrukturprozessen unterstützt. Kommen Sie zu virtual7 und treiben Sie die Digitalisierung im öffentlichen Sektor voran.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 6 Monaten

PandaDoc

501 - 1000

☁️ SaaS

🤝 B2B

⚡ Produktivität

Senior Site‑Reliability‑Ingenieur bei PandaDoc, der zuverlässige Dienste mit minimalen Ausfallzeiten sicherstellt. Vorantreiben von Maßnahmen in den Bereichen Observability, Incident‑Management und Aufrechterhaltung zuverlässiger Betriebsabläufe.

🗣️🇺🇸🇬🇧 Englisch erforderlich

🕒 vor 7 Monaten

Famedly GmbH

11 - 50

🏥 Gesundheitswesen

💼 Beratung

📦 Logistik

Site Reliability Engineer fßr ein Healthcare-Startup zur Verbesserung der medizinischen Kommunikation. Entwurf von SRE-Praktiken zur ErhÜhung der Systemzuverlässigkeit und -leistung.

🗣️🇺🇸🇬🇧 Englisch erforderlich