Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure
Mediform GmbH
Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure at Mediform GmbH is a full time role based in Karlsruhe, Baden-Wurttemberg, Germany. Listed skills: Software Development. It was published on 27 July 2026 and was open at last check.
| Role | Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure |
|---|---|
| Company | Mediform GmbH |
| Location | Karlsruhe, Baden-Wurttemberg, Germany |
| Employment type | Full Time |
| Skills listed | Software Development |
| Published | 27 July 2026 |
| Status | Open at last check |
Position
- Level: Experienced Engineer - typischerweise drei bis sechs Jahre relevante Produktionserfahrung
- Gehalt: 75.000-95.000 Euro brutto pro Jahr, abhängig von Erfahrung und Verantwortungsumfang
- Hybrid: Während der Einarbeitung zwei bis drei Tage pro Woche in Karlsruhe, danach je nach Standort flexibel, bevorzugt ein bis zwei Tage pro Woche
Über Mediform
Mediform ist ein Health-Tech-Startup aus Karlsruhe. Mit MediVoice entwickeln wir einen KI-basierten Telefonassistenten, der Anliegen in Arztpraxen und MVZ autonom bearbeitet - von der Terminvergabe bis zur Rezeptanfrage.
Hinter jedem Anruf steht ein verteiltes System aus Telefonie, Echtzeit-Audioverarbeitung, KI-Diensten und Schnittstellen zu Praxisverwaltungssystemen. Genau hier kommst du ins Spiel.
Warum wir diese Rolle schaffen
Bisher haben die Engineers, die unser Produkt entwickeln, auch Infrastruktur, Observability und operative Schutzmechanismen aufgebaut. Mit unserem Wachstum schaffen wir nun erstmals eine dedizierte Reliability-Rolle: für eine Person, die Probleme eigenständig untersucht, fundierte Optionen erarbeitet und die gewählte Lösung verlässlich in Produktion bringt.
Wir priorisieren Reliability-Themen gemeinsam. Du verantwortest Untersuchung, Entscheidungsgrundlage, Umsetzung und Follow-through. In den kommenden zwei bis drei Jahren kann dein Verantwortungsbereich mit wachsendem Kontext und Vertrauen bis zur übergreifenden Gestaltung der Reliability-Disziplin bei Mediform wachsen.
Aufgaben
- Systeme robust machen: Du sorgst für Workload-Isolation, Redundanz, sinnvolles Autoscaling und passende Cluster-Kapazität - genug Reserven für Lastspitzen, ohne unnötig Ressourcen laufen zu lassen. Störungen sollen gar nicht erst zu Ausfällen werden.
- Bekannte Schwachstellen durchdringen: Du untersuchst bekannte Zuverlässigkeitsrisiken, sammelst belastbare Evidenz und bringst konkrete Handlungsoptionen mit.
- Lösungen umsetzen: Du baust Verbesserungen selbst - als Produktionscode, Infrastructure as Code, Automatisierung, Test, Runbook oder technischen Schutzmechanismus.
- Observability betreuen und weiterentwickeln: Du übernimmst die Pflege unserer Alerting-Infrastruktur und verbesserst Signale, Alert-Ownership und Routing - echte Probleme erreichen sofort die richtigen Menschen, Rauschen erreicht niemanden.
- Plattform aktuell halten: Du hältst Kubernetes, Infrastruktur-Charts und Komponenten in einem Rhythmus aktuell, der Lifecycle-Risiken kontrolliert, ohne jedes Upgrade zur Top-Priorität zu machen.
- Incidents methodisch begleiten: Du arbeitest bei Störungen ruhig und methodisch mit, trennst Fakten von Annahmen und treibst die abgeleiteten Verbesserungen bis zum Abschluss. Die systemübergreifende Ursachenanalyse wächst mit deinem Systemwissen - sie ist ausdrücklich keine Erwartung ab Tag eins.
- Gemeinsame Verantwortung stärken: Du arbeitest eng mit den Produktteams zusammen. Sie behalten die Verantwortung für ihre Systeme; du stärkst gemeinsame Reliability-Praktiken und treibst vereinbarte Maßnahmen bis zum Abschluss.
Die Reihenfolge legen wir anhand von Wirkung, Risiko und Aufwand gemeinsam fest.
Qualifikation
- Produktionserfahrung: Typischerweise drei bis sechs Jahre Arbeit mit produktiven Systemen, etwa in DevOps, SRE, Backend oder Infrastructure Engineering. Entscheidend ist die Qualität deiner Erfahrung, nicht die exakte Jahreszahl.
- Troubleshooting und Engineering: Du gehst auch in unbekannten verteilten Systemen methodisch vor, denkst in Failure Modes und Blast Radius und setzt Verbesserungen hands-on in Code, IaC und Automatisierung um.
- Eigeninitiative: Du wartest nicht nur auf Tickets, sondern bemerkst Probleme, gehst ihnen nach und bringst durchdachte Optionen mit.
- Zusammenarbeit: Du überzeugst durch Evidenz statt Hierarchie, kannst eine andere Teamentscheidung professionell mittragen und sprichst erneut klar an, wenn neue Erkenntnisse die Lage verändern.
- Sicherheitsbewusstsein: Bei patientennahen Systemen behandelst du Identität, korrektes Routing, Mandantentrennung und Fail-closed-Verhalten als Teil der Zuverlässigkeit - und fragst nach, bevor du eine unsichere Grenze überschreitest.
- Reflektierte KI-Nutzung: Du nutzt KI-Werkzeuge pragmatisch, hältst aber Verifikation, Kontext und Verantwortung beim Menschen.
- Sprachen: Sehr gutes Englisch. Deutsch ist hilfreich, aber für diese interne Engineering-Rolle kein Muss.
Ein vollständiger Stack-Match ist nicht nötig. Entscheidend sind deine Arbeitsweise, echte Produktionserfahrung und die Fähigkeit, neue technische Domänen zuverlässig zu erschließen.
Unser technischer Kontext:
Unser Umfeld umfasst AWS, Kubernetes/EKS, EC2, RDS/PostgreSQL, Prometheus, Grafana, Loki, Sentry, Linux-Netzwerke und Infrastructure as Code. Hinzu kommen SIP/RTP-basierte Telefonie, Echtzeit-Audio, GPU-Workloads, externe KI-Dienste sowie Integrationen mit Termin- und Praxisverwaltungssystemen.
Erfahrung mit einzelnen Teilen davon ist ein Plus, aber keine Voraussetzung.
Wie wir arbeiten:
Wir treffen technische Entscheidungen in offener Diskussion statt über Hierarchie. Gut begründete Bedenken haben Gewicht, und wir ändern den Kurs, wenn die Evidenz dafür spricht.
Diese Rolle trägt echte Verantwortung, ist aber nicht der Ort, an den Produktionsprobleme oder Schuld weitergereicht werden. Bei Incidents verbessern wir Schutzmechanismen und klären Verantwortlichkeiten - ohne Sündenböcke oder Heldenkultur.
Unser Anrufvolumen beginnt gegen 07: 00 Uhr und steigt ab 08:00 Uhr stark an. Ein früher Arbeitsbeginn ist praktisch, aber wir suchen keine dauerhaft verfügbare Frühschicht. Wir suchen jemanden, der mit uns sicherstellt, dass ein Ausfall um 07:00 Uhr eine entworfene und getestete Antwort hat - unabhängig vom persönlichen Tagesrhythmus.
Wir sind AI-native: KI gehört für uns zu Code, Untersuchung und Entscheidungsvorbereitung. Urteilsvermögen, Verifikation und Verantwortung bleiben menschlich.
Benefits
- Eine seltene Kombination aus Cloud-Infrastruktur, Echtzeit-Audio, Telefonie und KI in einem patientennahen Produkt.
- Eine dedizierte Rolle mit eigenem Umsetzungsraum und erfahrenen Engineers als Partner.
- Eine klare Entwicklungsperspektive bis zur übergreifenden Gestaltung der Reliability-Disziplin.
- Hybrides Arbeiten mit einem modernen Büro im Herzen von Karlsruhe.
- Während der Einarbeitung zwei bis drei Tage pro Woche in Karlsruhe, danach je nach Standort flexibel, bevorzugt ein bis zwei Tage pro Woche.
- Ein persönliches Weiterentwicklungsbudget und fachliches Mentoring.
Bewerbungsprozess
- Remote-Kennenlernen (30 Minuten): Hintergrund, Erwartungen und Rolle.
- Technischer Deep Dive: Ein realistischer Reliability-Fall; uns interessieren deine Fragen, Hypothesen und Entscheidungen, nicht auswendig gelernte Tooldetails.
- Teamgespräch in Karlsruhe: Gegenseitiges Kennenlernen und Raum für offene Fragen.
Deine Bewerbung
Ein klassisches Anschreiben ist nicht nötig. Schick uns deinen Lebenslauf (Zeugnisse optional) und beantworte stattdessen kurz diese Frage:
Erzähle uns von einem Produktionsproblem, das dir selbst aufgefallen ist, ohne dass es als Ticket existierte. Wie hast du es untersucht, welche Optionen hast du vorgeschlagen und was wurde anschließend umgesetzt?
Wir freuen uns darauf, dich kennenzulernen.
Create your free OnJob profile to apply — we'll take you to Mediform GmbH's application after sign-up. · Posted 27 Jul 2026.
Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure at Mediform GmbH — questions answered
What does the Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure role at Mediform GmbH pay?
Mediform GmbH does not publish a salary on this Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure listing, so OnJob shows no figure for it rather than an estimate. For what this role pays across the market, the OnJob salary guides aggregate the live listings that do disclose pay.
Where is the Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure role at Mediform GmbH based?
Mediform GmbH lists this Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure role in Karlsruhe, Baden-Wurttemberg, Germany, advertised as full time work at that location. Larger employers sometimes cover several sites under one city name, so confirm the exact office with Mediform GmbH before you apply.
What skills does the Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure role at Mediform GmbH require?
The Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure at Mediform GmbH listing names Software Development. Those are the skills the employer put on the posting itself, so they are the ones worth matching in your profile and covering first in an interview.
Is the Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure role at Mediform GmbH still open?
The Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure posting at Mediform GmbH was open at OnJob's last check of the employer's careers page, having been published on 27 July 2026. OnJob re-checks source listings on each build and marks a role closed once it disappears, but listings can close without notice, so the employer's own page is the final word.
How do you apply for the Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure role at Mediform GmbH?
Apply to the Site Reliability Engineer (m/w/d) - AI Healthcare Infrastructure at Mediform GmbH role through OnJob with a free profile: OnJob scores your fit against the listing, shows the skills lowering that score, and submits an ATS-ready profile to Mediform GmbH's own application page. Creating a profile is free and needs no card.
Related Data & AI jobs
Hand-picked roles that match this listing on skills, category and location — each scored to your profile inside OnJob.
Explore more on OnJob
Hiring for a role like this?
Post a job on OnJob and reach AI-matched candidates.