Resources / Case Studies

Données d'entraînement multilingues pour un chatbot de services aux citoyens dans un programme d'IA gouvernemental

Une initiative de services numériques du secteur public avait besoin de données d'entraînement dans plusieurs langues locales pour lancer un chatbot de services aux citoyens capable de répondre aux questions courantes sur les services publics dans les langues réellement parlées par les habitants.

Client snapshot

IndustryServices numériques de l'administration et du secteur public
RegionAfrique de l'Ouest
Engagement typeCollecte et évaluation de données d'entraînement conversationnelles multilingues

The challenge

Le prototype de chatbot existant du programme ne fonctionnait qu'en anglais, ce qui excluait une grande part de la population qu'il devait servir, et aucun fournisseur existant ne pouvait démontrer une véritable couverture de locuteurs natifs dans les langues locales requises au volume nécessaire.

The approach

Jwuma a recruté des contributeurs locuteurs natifs des langues locales requises pour produire des exemples représentatifs de requêtes de citoyens et évaluer l'exactitude et la pertinence des réponses du chatbot dans chaque langue, avec une remontée de revue pour les jugements contestés ou ambigus sur la qualité des réponses.

Results

Le programme a étendu la couverture linguistique fonctionnelle de son chatbot aux langues locales les plus couramment parlées par la population qu'il servait, élargissant sensiblement le nombre de personnes pouvant utiliser le service dans leur propre langue.

Frequently asked questions

Pourquoi les services d'IA du secteur public ont-ils spécifiquement besoin de données d'entraînement en langue maternelle ?

Parce que les chatbots de services aux citoyens qui ne fonctionnent que dans la langue officielle ou administrative d'un pays excluent de larges pans de la population qui parlent au quotidien d'autres langues locales.

Comment Jwuma trouve-t-elle des locuteurs natifs pour des langues moins souvent prises en charge ?

Par un recrutement de contributeurs vérifiés directement dans les régions où ces langues sont parlées, plutôt que par le recours à des intermédiaires bilingues.

Cette approche peut-elle s'étendre à d'autres langues à mesure qu'un programme se développe ?

Oui, à condition que des réseaux de contributeurs locuteurs natifs existent ou puissent être constitués pour les langues cibles supplémentaires.

Discuter d'un programme de données linguistiques pour le secteur public →

Published 2026-10-02 by Jwuma, operated by Corpshore AI. This case study is an anonymized composite representative of the kind of work Jwuma performs in this industry, described by industry, region and engagement type rather than by company name, since this engagement is not yet cleared for public naming. Discuss a similar program at client.corpshore.ai.