Alle offenen Stellen
Engineering · Vollzeit

AI Engineer (m/w/d)

Plattform und AI Gateway für den produktiven Betrieb

Du entwickelst mit uns das Backbone der Rinascai Suite weiter. Über sie orchestrieren wir jeden AI-Traffic, im Frontend wie im hochperformanten Backend, das mit jedem Mandanten mitwächst.

Arbeitsort
HybridKarlsruhe / ZürichZu Beginn hybrides Arbeiten, Präsenztage nach Absprache
Umfang
Vollzeit40 Std./Woche
Vertrag
Unbefristet
Jetzt bewerben

Über uns

Rinascai stellt mittleren und großen Unternehmen im DACH-Raum den externen AI Officer und bringt KI von der Diagnose bis in den produktiven, EU-AI-Act-konformen Betrieb. Dazu gehört die Rinascai AI Suite mit Prozesslandkarten, Governance-Dokumentation, Risikoklassifizierung, Kostenkontrolle und dem Gateway für EU-Hosting, Pseudonymisierung und kontrollierte Modellzugriffe.

Rinascai ist aus der Operating- und Data-Analytics-Praxis von OPCORE Partners hervorgegangen. Die Sitze liegen in Karlsruhe und Zürich, Ansprechpartner gibt es an zentralen DACH-Standorten. Zu den Referenzen des Teams zählen unter anderem Otto Group, METRO, Lidl, Breuninger und FRITZ! (AVM).

Worum es geht

Jedes Produkt von Rinascai nutzt Modelle über eine gemeinsame Plattform: ein Zugang, Schlüssel je Mandant, ein Protokoll, das vor einem Prüfer standhält. Kein Demo-Stack. Was hier gebaut wird, geht in den produktiven Betrieb.

Als AI Engineer verantwortest du diese Plattform von der Infrastruktur bis zum Betrieb. Du bringst den bestehenden Stack auf europäische Infrastruktur, automatisierst Deployments und überführst sie in den produktiven Einsatz.

Darauf baust du das AI Gateway: ein Zugang für alle Modelle, mit Schlüsseln und Kontingenten je Mandant, und einen Model Router, der je Anfrage zuerst nach Rechtsraum entscheidet und erst danach nach Kosten. Nach Kosten routet der Markt ohnehin. Nach Rechtsraum routet kaum jemand.

Dazu kommen der Pseudonymisierungslayer, der Personenbezug vor dem Modellaufruf ersetzt, FinOps und Chargeback für die Kostenweiterbelastung je Mandant, und die Grundlage für kontrollierte agentische Werkzeuge über MCP (Model Context Protocol), mit Human in the Loop.

Deine Verantwortung

  • Plattformübernahme

    Du bringst den bestehenden Stack auf europäische Infrastruktur, automatisierst Deployments und überführst ihn in den produktiven Betrieb.

  • AI Gateway

    Du baust einen Zugang für alle Modelle mit Schlüsseln und Kontingenten je Mandant, das Audit-Log entsteht als Nebenprodukt des Betriebs.

  • Pseudonymisierungslayer

    Du ersetzt Personenbezug vor dem Modellaufruf und setzt ihn nach der Antwort wieder ein, geschärft auf deutsche Datenformate.

  • Model Router

    Du entscheidest je Anfrage zuerst nach Rechtsraum und erst dann nach Kosten, mit Caching, Failover und Budgets.

  • FinOps und Chargeback

    Du machst den Verbrauch je Mandant und Abteilung sichtbar und ermöglichst die Kostenweiterbelastung.

  • Action Layer

    Du legst die Grundlage für die kontrollierte Nutzung agentischer Werkzeuge über MCP, mit Human in the Loop.

  • Technologie-Scouting

    Du verfolgst eigenmotiviert neue Open-Source-Lösungen und Ansätze, prüfst sie effizient gegen unsere Unternehmensziele und führst das Tragfähige in Abstimmung mit dem Team und der Produkt-Roadmap in den produktiven Betrieb.

Unser Tech-Stack

Sprachen

Python und TypeScript.

Container und Automatisierung

Docker, Kubernetes oder eine vergleichbare Orchestrierung, CI/CD und Infrastructure as Code.

Infrastruktur

Europäische Infrastruktur als Rechtsraum-Grundlage für alle Deployments.

Modelle

Open-Weight-Modelle und Frontier-APIs, angebunden über das AI Gateway.

Integration und Automatisierung

MCP für agentische Werkzeuge, n8n für Workflow-Automatisierung.

Das bringst du mit

Must-have
  • Mehrjährige Verantwortung in Platform Engineering, Backend oder SRE (Site Reliability Engineering), nachweislich in produktiven KI-Workloads.
  • Ein LLM-Gateway (Large Language Model), einen Proxy oder Router selbst gebaut und betrieben, mit Schlüsselverwaltung, Kontingenten und Protokollierung.
  • Python sicher, dazu TypeScript.
  • Docker sicher und Kubernetes oder eine vergleichbare Orchestrierung im produktiven Einsatz, dazu CI/CD (Continuous Integration und Continuous Delivery) und Infrastructure as Code.
  • Sicherheit und Mandantenfähigkeit als Entwurfsprinzip.
    • RBAC (Role Based Access Control)
    • Secrets-Management
    • Audit-Logs
  • Deutsch verhandlungssicher, Englisch fließend.
  • Eigenmotivation im Technologie-Scouting: Du verfolgst die Open-Source-Landschaft, testest Ansätze mit überschaubarem Aufwand und begründest, warum einer davon für uns trägt.
  • Routine im AI-assisted Coding. Konkret heißt das für uns:
    • Du orchestrierst Coding-Agents und gibst ihnen klaren Scope und Akzeptanzkriterien.
    • Du schreibst eigene Skills und Instruktionen, statt jedes Mal bei null zu prompten.
    • Du richtest Entwicklungs-Workflows und CI/CD-Pipelines so ein, dass Agents darin verlässlich arbeiten.
Nice to have
  • Pseudonymisierung und Erkennung personenbezogener Daten in Freitext (DLP, Data Loss Prevention), idealerweise mit deutschen Datenformaten.
  • Modell-Serving von Open-Weight-Modellen auf europäischer Infrastruktur, etwa mit vLLM oder Ray Serve.
  • Eigene MCP-Server oder Registry, dazu Workflow-Automatisierung mit n8n.
  • Aufbau und Betrieb von Retrieval-Pipelines (RAG, Retrieval Augmented Generation).
  • Regulatorik im Betriebskontext: EU AI Act, ISO 27001, ISO 42001.

Wie wir arbeiten

Du arbeitest fachlich direkt mit dem CPTO, flache Struktur, keine Zwischenebene.

Sicherheit und Mandantenfähigkeit sind Entwurfsprinzip: RBAC, Secrets-Management und Audit-Logs gehören von Anfang an dazu, nicht erst als Nachrüstung.

Du bist für diese Plattformlinie in alleiniger Verantwortung zuständig, von der Architektur bis in den Betrieb.

Wir setzen KI in der Entwicklung produktiv ein, nicht als Experiment. Unsere Entwicklungs-Workflows sind darauf ausgelegt, dass Agents darin arbeiten. Wir erwarten allerdings, dass du dem Output eines Agenten genauso kritisch begegnest wie einem fremden Pull Request.

Was wir bieten

Verantwortung

Eine Plattformlinie in alleiniger Verantwortung, von der Architektur bis in den Betrieb.

Führung

Fachlich direkt durch den CPTO, flache Struktur, keine Zwischenebene.

Stack

Europäische Infrastruktur, Open-Weight-Modelle und Frontier-APIs, MCP und n8n.

Hybrides Arbeiten

Feste Tage in Karlsruhe oder Zürich, der Rest flexibel.

Entwicklung

Weiterbildung und geförderte Zertifizierungen.

30 Tage Urlaub

Zusätzlich zu den gesetzlichen Feiertagen.

40-Stunden-Woche

Feste Arbeitszeit, keine kaschierte Mehrarbeit.

Unbegrenztes Token-Budget

Für AI-assisted Coding und die Tools deiner Wahl.

Unser Bewerbungsprozess
  1. 01Screening deiner Bewerbungsunterlagen
  2. 02Kennenlernen30 Minuten
  3. 03Praxisaufgabe als Fach-Challenge
  4. 04Gespräch zu den Findingsund Abstimmung der Rahmenbedingungen
  5. 05Abschlussgespräch, Angebot und Kennenlernen des Teams
  6. 06Onboarding

Jetzt bewerben

Ein Einstieg als Freelancer ist möglich, die Festanstellung folgt im Anschluss.

Unterlagen senden

hello@rinascai.com

Ihre Ansprechpartner
  • Jean-Luc WinklerCTO / CPO