Prüfung und Annotation juristischer Dokumente für eine Legal-Tech-Plattform
Ein Legal-Technology-Unternehmen, das eine KI zur Vertragsprüfung entwickelt, benötigte die strukturierte Annotation juristischer Dokumente, um sein Modell darauf zu trainieren, Klauseln, Pflichten und Risikoindikatoren in unterschiedlichen Vertragstypen korrekt zu erkennen.
Client snapshot
| Industry | Legal Technology |
|---|---|
| Region | Nordamerika und Vereinigtes Königreich |
| Engagement type | Klauselannotation juristischer Dokumente und Labeling von Risikoindikatoren |
The challenge
Der Kunde benötigte Annotatoren, die juristische Klauseltypen und Risikoformulierungen in einer großen Vielfalt von Vertragsformaten korrekt erkennen. Diese Aufgabe erfordert mehr fachliche Vertrautheit als allgemeines Text-Labeling und mehr Volumen, als sein internes Rechtsteam leisten konnte.
The approach
Jwuma wies Annotatoren zu, die anhand der Klauseltaxonomie und der durchgerechneten Beispiele des Kunden geschult waren, wandte angesichts der fachlichen Komplexität eine mehrstufige Prüfung an und eskalierte mehrdeutige Klauselklassifizierungen an eine QA-Stufe, statt sie dem Urteil eines einzelnen Annotators zu überlassen.
Results
Der Kunde erhielt einheitlich annotierte Vertragsdaten entlang seiner Zielklauseltaxonomie, was die Fähigkeit seines Modells unterstützte, über seinen ursprünglichen Trainingsdatensatz hinaus auf unterschiedliche Vertragsformate zu generalisieren.
Frequently asked questions
Erfordert die Annotation juristischer Dokumente eine juristische Ausbildung?
Annotatoren werden speziell anhand der Klauseltaxonomie und der durchgerechneten Beispiele des Kunden geschult, ohne dass ein Jurastudium erforderlich ist, und mehrdeutige Fälle werden an eine Prüfstufe eskaliert.
Warum ist die Vielfalt von Vertragsformaten eine Herausforderung für Trainingsdaten juristischer KI?
Weil sich Verträge in Aufbau und Sprache zwischen Branchen und Rechtsordnungen erheblich unterscheiden und ein Modell, das auf einen engen Satz von Formaten trainiert wurde, auf die übrigen schlecht generalisiert.
Wie wird die Annotationsgenauigkeit bei juristischen Dokumentdaten überprüft?
Durch mehrstufige Prüfeskalation bei mehrdeutigen Klauselklassifizierungen, sodass in strittigen Fällen die Auslegung eines einzelnen Annotators nicht endgültig ist.
Related case studies
Gesichts- und Identitätsverifizierungsdaten für eine globale Mobilitätsplattform
Eine globale Mobilitäts- und Ride-Hailing-Plattform benötigte verifizierte Gesichts- und Identitätsdaten aus mehreren Regionen, um ein Verifizierungssystem für die Sicherheit von Fahrern und Fahrgästen zu stärken, unter strengen Anforderungen an Einwilligung und Umgang mit biometrischen Daten.
Erhebung egozentrischer Videodaten für ein Robotik-KI-Programm
Ein Robotik-KI-Unternehmen benötigte Videos aus der Ich-Perspektive von Menschen, die alltägliche physische Aufgaben ausführen, einheitlich erfasst in vielfältigen Umgebungen und mit unterschiedlichen Körpertypen, um ein Embodied-AI-Modell so zu trainieren, dass es über eine einzelne Laborumgebung hinaus generalisiert.
RLHF-Evaluierung für ein Konversations-KI-Modell
Ein Unternehmen für Konversations-KI benötigte eine strukturierte, skalierbare menschliche Evaluierungs-Pipeline, um die Antwortqualität seiner Chatbots für den RLHF-Feinabstimmungsprozess zu bewerten, nachdem sein bisheriger Ad-hoc-Rater-Pool uneinheitliche Bewertungen geliefert hatte.
Published 2026-10-02 by Jwuma, operated by Corpshore AI. This case study is an anonymized composite representative of the kind of work Jwuma performs in this industry, described by industry, region and engagement type rather than by company name, since this engagement is not yet cleared for public naming. Discuss a similar program at client.corpshore.ai.