Nennen Sie die Aufgabe.
Sieben Formen von Arbeit, in den Worten, nach denen Sie suchen würden. Alle teilen dasselbe Rückgrat: deterministisch, wo es zählt, revisionssicher immer, Modelle nur dort, wo sie ihren Platz verdienen.
LLM-Integration
Das Modell bekommt einen Platz, nicht die Schlüssel. Eingebaut in Ihren Stack mit einem Schema an jedem Ausgang, einem Fehlerpfad für jeden Aufruf und keinem Weg zu einer Zahl, die jemand unterschreibt.
CLAUDE- & GPT-APIS · SCHEMA-FIXIERTE AUSGABEN · CIRCUIT BREAKER · KOSTENBUDGETS
RAG-Pipelines, die wahr bleiben
Retrieval baut man leicht einmal und hält es schwer ehrlich. Ingestion mit Quellenverfolgung, versionierte Indizes, jeder Neuaufbau vor der Freigabe evaluiert — Rollback ist ein Zeigerwechsel.
VEKTORSUCHE · EMBEDDINGS · FRISCHE-MONITORING · EVAL-SETS
KI-Agenten mit Grenzen
Ein Agent, der eskaliert, ist nützlich. Ein Agent, der rät, ist ein Risiko. Mehrschrittige Workflows, in denen jede folgenreiche Aktion im Code validiert wird oder bei einem Menschen landet.
AGENTEN-WORKFLOWS · TOOL-DESIGN · HUMAN-IN-THE-LOOP · ESKALATIONSPFADE
Dokumentenextraktion im Maßstab
Echte Dokumente sind Fotografien von Papier: gedreht, gestempelt, zweisprachig, Arabisch neben Latein. Typisierte Datensätze, in denen jedes Feld auf eine Region einer Seite zurückführt — das Günstigste zuerst, Modelle zuletzt.
OCR + LAYOUT · GEMISCHTE SCHRIFTEN (AR/LAT) · ABGLEICH · NULL-TOKEN-PFADE
EU AI Act & Prüfbereitschaft
Der Omnibus 2026 hat die Hochrisiko-Fristen auf 2027/28 verschoben — und ein System, das vor seinem Stichtag am Markt ist, bleibt von diesem Regime weitgehend ausgenommen. Früh liefern ist die Strategie, und was Prüfer verlangen, baue ich ohnehin: Nachvollziehbarkeit, menschliche Aufsicht und eine Grenze, die man ihnen zeigen kann.
AUDIT-TRAILS · REPLAY · RISIKODOKUMENTATION · KI-GOVERNANCE
Rettungsarbeit
Schon einen Agenten ausgeliefert, der Ihnen Angst macht? Ich finde jeden Pfad, auf dem ein Modell eine Zahl berühren kann, kappe ihn und lasse die Architektur die Linie halten — ohne Neuentwicklung.
GRENZEN-NACHRÜSTUNG · EVAL-HARNESSE · HÄRTUNG NACH VORFALL
Evals, die Releases gaten
Ein Modell-Feature ohne Eval-Harness ist eine Demo. Golden Sets mit Erwartungswerten, die vor dem Code existieren; aufgezeichnete Antworten, die den deterministischen Teil eines LLM-Pfads festnageln; Defekt-Reproduktionen, die den Build brechen, sobald sie still verheilen — und Fehler-Floors, die sich nur nach oben bewegen.
GOLDEN SETS · LLM-REPLAY-REGRESSION · STRIKTE XFAIL-REPROS · NULL-FEHLER-FLOORS
WENN IHRE AUFGABE NICHT AUF DER LISTE STEHT, ABER SO KLINGT: SCHREIBEN SIE TROTZDEM. DER FILTER IST DAS RÜCKGRAT, NICHT DAS ETIKETT.