🌍 Global Careers Hub: Verified international opportunities & direct employer pipelines across US, UK, Canada, Australia & 100% Remote. Browse Remote Roles →
← Back to all job openings
M

Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure

🏒 Mediform GmbH βœ“ Verified Direct Employer
πŸ“ Karlsruhe ⚑ Direct Opportunity πŸ•’
Work Model
πŸ“ Karlsruhe
Employment
πŸ’Ό Full-Time Direct
Recruitment Type
πŸ›‘οΈ Direct to HR Pipeline
πŸ’°

Salary & Compensation Transparency

βœ“ Equal Pay & Transparency Compliant
Competitive Direct Compensation Benchmark: $70,000 – $130,000 / yr
πŸ₯ Comprehensive Health & Dental
πŸ–οΈ Paid Time Off (PTO) & Holidays
πŸ“ˆ Retirement 401(k) / Pension Match
βš–οΈ Equal Opportunity Pay Scale
πŸ›‘οΈ
Verified Direct Employer Opening: You are submitting directly to Mediform GmbH's recruitment pipeline with zero intermediary fees.

Role Overview & Responsibilities

Position

  • Level: Experienced Engineer - typischerweise drei bis sechs Jahre relevante Produktionserfahrung
  • Gehalt: 75.000-95.000 Euro brutto pro Jahr, abhΓ€ngig von Erfahrung und Verantwortungsumfang
  • Hybrid: WΓ€hrend der Einarbeitung zwei bis drei Tage pro Woche in Karlsruhe, danach je nach Standort flexibel, bevorzugt ein bis zwei Tage pro Woche

Über Mediform

Mediform ist ein Health-Tech-Startup aus Karlsruhe. Mit MediVoice entwickeln wir einen KI-basierten Telefonassistenten, der Anliegen in Arztpraxen und MVZ autonom bearbeitet - von der Terminvergabe bis zur Rezeptanfrage.

Hinter jedem Anruf steht ein verteiltes System aus Telefonie, Echtzeit-Audioverarbeitung, KI-Diensten und Schnittstellen zu Praxisverwaltungssystemen. Genau hier kommst du ins Spiel.

Warum wir diese Rolle schaffen

Bisher haben die Engineers, die unser Produkt entwickeln, auch Infrastruktur, Observability und operative Schutzmechanismen aufgebaut. Mit unserem Wachstum schaffen wir nun erstmals eine dedizierte Reliability-Rolle: fΓΌr eine Person, die Probleme eigenstΓ€ndig untersucht, fundierte Optionen erarbeitet und die gewΓ€hlte LΓΆsung verlΓ€sslich in Produktion bringt.

Wir priorisieren Reliability-Themen gemeinsam. Du verantwortest Untersuchung, Entscheidungsgrundlage, Umsetzung und Follow-through. In den kommenden zwei bis drei Jahren kann dein Verantwortungsbereich mit wachsendem Kontext und Vertrauen bis zur ΓΌbergreifenden Gestaltung der Reliability-Disziplin bei Mediform wachsen.

Aufgaben

  • Systeme robust machen: Du sorgst fΓΌr Workload-Isolation, Redundanz, sinnvolles Autoscaling und passende Cluster-KapazitΓ€t - genug Reserven fΓΌr Lastspitzen, ohne unnΓΆtig Ressourcen laufen zu lassen. StΓΆrungen sollen gar nicht erst zu AusfΓ€llen werden.
  • Bekannte Schwachstellen durchdringen: Du untersuchst bekannte ZuverlΓ€ssigkeitsrisiken, sammelst belastbare Evidenz und bringst konkrete Handlungsoptionen mit.
  • LΓΆsungen umsetzen: Du baust Verbesserungen selbst - als Produktionscode, Infrastructure as Code, Automatisierung, Test, Runbook oder technischen Schutzmechanismus.
  • Observability betreuen und weiterentwickeln: Du ΓΌbernimmst die Pflege unserer Alerting-Infrastruktur und verbesserst Signale, Alert-Ownership und Routing - echte Probleme erreichen sofort die richtigen Menschen, Rauschen erreicht niemanden.
  • Plattform aktuell halten: Du hΓ€ltst Kubernetes, Infrastruktur-Charts und Komponenten in einem Rhythmus aktuell, der Lifecycle-Risiken kontrolliert, ohne jedes Upgrade zur Top-PrioritΓ€t zu machen.
  • Incidents methodisch begleiten: Du arbeitest bei StΓΆrungen ruhig und methodisch mit, trennst Fakten von Annahmen und treibst die abgeleiteten Verbesserungen bis zum Abschluss. Die systemΓΌbergreifende Ursachenanalyse wΓ€chst mit deinem Systemwissen - sie ist ausdrΓΌcklich keine Erwartung ab Tag eins.
  • Gemeinsame Verantwortung stΓ€rken: Du arbeitest eng mit den Produktteams zusammen. Sie behalten die Verantwortung fΓΌr ihre Systeme; du stΓ€rkst gemeinsame Reliability-Praktiken und treibst vereinbarte Maßnahmen bis zum Abschluss.

Die Reihenfolge legen wir anhand von Wirkung, Risiko und Aufwand gemeinsam fest.

Qualifikation

  • Produktionserfahrung: Typischerweise drei bis sechs Jahre Arbeit mit produktiven Systemen, etwa in DevOps, SRE, Backend oder Infrastructure Engineering. Entscheidend ist die QualitΓ€t deiner Erfahrung, nicht die exakte Jahreszahl.
  • Troubleshooting und Engineering: Du gehst auch in unbekannten verteilten Systemen methodisch vor, denkst in Failure Modes und Blast Radius und setzt Verbesserungen hands-on in Code, IaC und Automatisierung um.
  • Eigeninitiative: Du wartest nicht nur auf Tickets, sondern bemerkst Probleme, gehst ihnen nach und bringst durchdachte Optionen mit.
  • Zusammenarbeit: Du ΓΌberzeugst durch Evidenz statt Hierarchie, kannst eine andere Teamentscheidung professionell mittragen und sprichst erneut klar an, wenn neue Erkenntnisse die Lage verΓ€ndern.
  • Sicherheitsbewusstsein: Bei patientennahen Systemen behandelst du IdentitΓ€t, korrektes Routing, Mandantentrennung und Fail-closed-Verhalten als Teil der ZuverlΓ€ssigkeit - und fragst nach, bevor du eine unsichere Grenze ΓΌberschreitest.
  • Reflektierte KI-Nutzung: Du nutzt KI-Werkzeuge pragmatisch, hΓ€ltst aber Verifikation, Kontext und Verantwortung beim Menschen.
  • Sprachen: Sehr gutes Englisch. Deutsch ist hilfreich, aber fΓΌr diese interne Engineering-Rolle kein Muss.

Ein vollstÀndiger Stack-Match ist nicht nâtig. Entscheidend sind deine Arbeitsweise, echte Produktionserfahrung und die FÀhigkeit, neue technische DomÀnen zuverlÀssig zu erschließen.

Unser technischer Kontext:

Unser Umfeld umfasst AWS, Kubernetes/EKS, EC2, RDS/PostgreSQL, Prometheus, Grafana, Loki, Sentry, Linux-Netzwerke und Infrastructure as Code. Hinzu kommen SIP/RTP-basierte Telefonie, Echtzeit-Audio, GPU-Workloads, externe KI-Dienste sowie Integrationen mit Termin- und Praxisverwaltungssystemen.

Erfahrung mit einzelnen Teilen davon ist ein Plus, aber keine Voraussetzung.

Wie wir arbeiten:

Wir treffen technische Entscheidungen in offener Diskussion statt ΓΌber Hierarchie. Gut begrΓΌndete Bedenken haben Gewicht, und wir Γ€ndern den Kurs, wenn die Evidenz dafΓΌr spricht.

Diese Rolle trΓ€gt echte Verantwortung, ist aber nicht der Ort, an den Produktionsprobleme oder Schuld weitergereicht werden. Bei Incidents verbessern wir Schutzmechanismen und klΓ€ren Verantwortlichkeiten - ohne SΓΌndenbΓΆcke oder Heldenkultur.

Unser Anrufvolumen beginnt gegen 07:00 Uhr und steigt ab 08:00 Uhr stark an. Ein frΓΌher Arbeitsbeginn ist praktisch, aber wir suchen keine dauerhaft verfΓΌgbare FrΓΌhschicht. Wir suchen jemanden, der mit uns sicherstellt, dass ein Ausfall um 07:00 Uhr eine entworfene und getestete Antwort hat - unabhΓ€ngig vom persΓΆnlichen Tagesrhythmus.

Wir sind AI-native: KI gehΓΆrt fΓΌr uns zu Code, Untersuchung und Entscheidungsvorbereitung. UrteilsvermΓΆgen, Verifikation und Verantwortung bleiben menschlich.

Benefits

  • Eine seltene Kombination aus Cloud-Infrastruktur, Echtzeit-Audio, Telefonie und KI in einem patientennahen Produkt.
  • Eine dedizierte Rolle mit eigenem Umsetzungsraum und erfahrenen Engineers als Partner.
  • Eine klare Entwicklungsperspektive bis zur ΓΌbergreifenden Gestaltung der Reliability-Disziplin.
  • Hybrides Arbeiten mit einem modernen BΓΌro im Herzen von Karlsruhe.
    WΓ€hrend der Einarbeitung zwei bis drei Tage pro Woche in Karlsruhe, danach je nach Standort flexibel, bevorzugt ein bis zwei Tage pro Woche.
  • Ein persΓΆnliches Weiterentwicklungsbudget und fachliches Mentoring.

Bewerbungsprozess

  1. Remote-Kennenlernen (30 Minuten): Hintergrund, Erwartungen und Rolle.
  2. Technischer Deep Dive: Ein realistischer Reliability-Fall; uns interessieren deine Fragen, Hypothesen und Entscheidungen, nicht auswendig gelernte Tooldetails.
  3. TeamgesprΓ€ch in Karlsruhe: Gegenseitiges Kennenlernen und Raum fΓΌr offene Fragen.

Deine Bewerbung

Ein klassisches Anschreiben ist nicht nΓΆtig. Schick uns deinen Lebenslauf (Zeugnisse optional) und beantworte stattdessen kurz diese Frage:

ErzÀhle uns von einem Produktionsproblem, das dir selbst aufgefallen ist, ohne dass es als Ticket existierte. Wie hast du es untersucht, welche Optionen hast du vorgeschlagen und was wurde anschließend umgesetzt?

Wir freuen uns darauf, dich kennenzulernen.

Find Jobs in Germany on Arbeitnow

πŸ›‘οΈ Trust & Safety: We actively screen all postings. Suspect fraud, expired listings, or misleading details?

Frequently Asked Questions

How do I apply for the Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure position at Mediform GmbH?

Click the “Apply for this Position” button on this page to submit your application directly to Mediform GmbH's HR pipeline without recruitment agency markups.

Is this role eligible for remote work or international relocation?

This position is based in Karlsruhe with potential relocation and visa sponsorship considerations for qualified candidates.

Are there any fees to apply through Li1?

No. Li1 is 100% free for all job applicants. We strictly prohibit recruitment fees or candidate placement charges.

✦ Recommended Opportunities

Similar Career Openings

Explore verified career opportunities with transparent compensation & visa sponsorship pathways.

✈️ Global Relocation Signal

This employer is eligible to sponsor work authorization visas (e.g. UK Skilled Worker Visa, US H-1B/O-1, Canada Global Talent Stream) for qualified international applicants.

Quick Apply Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure
-- Openings Active