Mehrsprachige Trainingsdaten für einen Bürgerservice-Chatbot in einem KI-Programm der öffentlichen Hand
Eine Initiative für digitale Dienste im öffentlichen Sektor benötigte Trainingsdaten in mehreren lokalen Sprachen, um einen Chatbot für Bürgerdienste zu starten, der häufige Fragen zu staatlichen Dienstleistungen in den Sprachen beantworten kann, die die Einwohner tatsächlich sprechen.
Client snapshot
| Industry | Digitale Dienste von Regierung und öffentlichem Sektor |
|---|---|
| Region | Westafrika |
| Engagement type | Erhebung und Evaluierung mehrsprachiger Konversationstrainingsdaten |
The challenge
Der bestehende Chatbot-Prototyp des Programms funktionierte nur auf Englisch, wodurch ein großer Teil der Bevölkerung ausgeschlossen blieb, der bedient werden sollte, und kein vorhandener Anbieter konnte eine echte muttersprachliche Abdeckung der erforderlichen lokalen Sprachen im nötigen Volumen nachweisen.
The approach
Jwuma rekrutierte muttersprachliche Contributors in den erforderlichen lokalen Sprachen, die repräsentative Beispiele für Bürgeranfragen erstellten und die Genauigkeit und Angemessenheit der Chatbot-Antworten in jeder Sprache bewerteten, mit Prüfeskalation bei strittigen oder mehrdeutigen Beurteilungen der Antwortqualität.
Results
Das Programm erweiterte die funktionale Sprachabdeckung seines Chatbots um die lokalen Sprachen, die in der bedienten Bevölkerung am häufigsten gesprochen werden, und erweiterte damit spürbar den Kreis derer, die den Dienst in ihrer eigenen Sprache nutzen konnten.
Frequently asked questions
Warum brauchen KI-Dienste im öffentlichen Sektor speziell muttersprachliche Trainingsdaten?
Weil Chatbots für Bürgerdienste, die nur in der Amts- oder Verwaltungssprache eines Landes funktionieren, große Teile der Bevölkerung ausschließen, die im Alltag andere lokale Sprachen sprechen.
Wie findet Jwuma Muttersprachler für seltener unterstützte Sprachen?
Durch die Rekrutierung verifizierter Contributors direkt in den Regionen, in denen diese Sprachen gesprochen werden, statt sich auf zweisprachige Mittler zu verlassen.
Lässt sich dieser Ansatz bei einer Programmerweiterung auf weitere Sprachen ausdehnen?
Ja, sofern Netzwerke muttersprachlicher Contributors für die zusätzlichen Zielsprachen bestehen oder aufgebaut werden können.
Related case studies
Gesichts- und Identitätsverifizierungsdaten für eine globale Mobilitätsplattform
Eine globale Mobilitäts- und Ride-Hailing-Plattform benötigte verifizierte Gesichts- und Identitätsdaten aus mehreren Regionen, um ein Verifizierungssystem für die Sicherheit von Fahrern und Fahrgästen zu stärken, unter strengen Anforderungen an Einwilligung und Umgang mit biometrischen Daten.
Erhebung egozentrischer Videodaten für ein Robotik-KI-Programm
Ein Robotik-KI-Unternehmen benötigte Videos aus der Ich-Perspektive von Menschen, die alltägliche physische Aufgaben ausführen, einheitlich erfasst in vielfältigen Umgebungen und mit unterschiedlichen Körpertypen, um ein Embodied-AI-Modell so zu trainieren, dass es über eine einzelne Laborumgebung hinaus generalisiert.
RLHF-Evaluierung für ein Konversations-KI-Modell
Ein Unternehmen für Konversations-KI benötigte eine strukturierte, skalierbare menschliche Evaluierungs-Pipeline, um die Antwortqualität seiner Chatbots für den RLHF-Feinabstimmungsprozess zu bewerten, nachdem sein bisheriger Ad-hoc-Rater-Pool uneinheitliche Bewertungen geliefert hatte.
Published 2026-10-02 by Jwuma, operated by Corpshore AI. This case study is an anonymized composite representative of the kind of work Jwuma performs in this industry, described by industry, region and engagement type rather than by company name, since this engagement is not yet cleared for public naming. Discuss a similar program at client.corpshore.ai.