№ 01 — DIE FÄHIGKEITEN · WOFÜR MAN MICH ENGAGIERT

Nennen Sie die Aufgabe.

Sieben Formen von Arbeit, in den Worten, nach denen Sie suchen würden. Alle teilen dasselbe Rückgrat: deterministisch, wo es zählt, revisionssicher immer, Modelle nur dort, wo sie ihren Platz verdienen.

LLM-Integration

Das Modell bekommt einen Platz, nicht die Schlüssel. Eingebaut in Ihren Stack mit einem Schema an jedem Ausgang, einem Fehlerpfad für jeden Aufruf und keinem Weg zu einer Zahl, die jemand unterschreibt.

CLAUDE- & GPT-APIS · SCHEMA-FIXIERTE AUSGABEN · CIRCUIT BREAKER · KOSTENBUDGETS

RAG-Pipelines, die wahr bleiben

Retrieval baut man leicht einmal und hält es schwer ehrlich. Ingestion mit Quellenverfolgung, versionierte Indizes, jeder Neuaufbau vor der Freigabe evaluiert — Rollback ist ein Zeigerwechsel.

VEKTORSUCHE · EMBEDDINGS · FRISCHE-MONITORING · EVAL-SETS

KI-Agenten mit Grenzen

Ein Agent, der eskaliert, ist nützlich. Ein Agent, der rät, ist ein Risiko. Mehrschrittige Workflows, in denen jede folgenreiche Aktion im Code validiert wird oder bei einem Menschen landet.

AGENTEN-WORKFLOWS · TOOL-DESIGN · HUMAN-IN-THE-LOOP · ESKALATIONSPFADE

Dokumentenextraktion im Maßstab

Echte Dokumente sind Fotografien von Papier: gedreht, gestempelt, zweisprachig, Arabisch neben Latein. Typisierte Datensätze, in denen jedes Feld auf eine Region einer Seite zurückführt — das Günstigste zuerst, Modelle zuletzt.

OCR + LAYOUT · GEMISCHTE SCHRIFTEN (AR/LAT) · ABGLEICH · NULL-TOKEN-PFADE

EU AI Act & Prüfbereitschaft

Der Omnibus 2026 hat die Hochrisiko-Fristen auf 2027/28 verschoben — und ein System, das vor seinem Stichtag am Markt ist, bleibt von diesem Regime weitgehend ausgenommen. Früh liefern ist die Strategie, und was Prüfer verlangen, baue ich ohnehin: Nachvollziehbarkeit, menschliche Aufsicht und eine Grenze, die man ihnen zeigen kann.

AUDIT-TRAILS · REPLAY · RISIKODOKUMENTATION · KI-GOVERNANCE

Rettungsarbeit

Schon einen Agenten ausgeliefert, der Ihnen Angst macht? Ich finde jeden Pfad, auf dem ein Modell eine Zahl berühren kann, kappe ihn und lasse die Architektur die Linie halten — ohne Neuentwicklung.

GRENZEN-NACHRÜSTUNG · EVAL-HARNESSE · HÄRTUNG NACH VORFALL

Evals, die Releases gaten

Ein Modell-Feature ohne Eval-Harness ist eine Demo. Golden Sets mit Erwartungswerten, die vor dem Code existieren; aufgezeichnete Antworten, die den deterministischen Teil eines LLM-Pfads festnageln; Defekt-Reproduktionen, die den Build brechen, sobald sie still verheilen — und Fehler-Floors, die sich nur nach oben bewegen.

GOLDEN SETS · LLM-REPLAY-REGRESSION · STRIKTE XFAIL-REPROS · NULL-FEHLER-FLOORS

WENN IHRE AUFGABE NICHT AUF DER LISTE STEHT, ABER SO KLINGT: SCHREIBEN SIE TROTZDEM. DER FILTER IST DAS RÜCKGRAT, NICHT DAS ETIKETT.

EINE AKTION. ZWEI ZEILEN: WAS ES JETZT TUT, WAS DANACH WAHR SEIN MUSS.
MAIL@ADAMSHAWA.COM

Verfügbarkeit & Kontakt →