行政のAIプログラム向けの多言語の市民サービスチャットボットの学習データ
公共部門のデジタルサービスの取り組みは、住民が実際に話す言語で、行政サービスに関するよくある質問に答えられる市民サービス向けチャットボットを始めるため、複数の現地語の学習データを必要としていました。
Client snapshot
| Industry | 行政および公共部門のデジタルサービス |
|---|---|
| Region | 西アフリカ |
| Engagement type | 多言語の会話型学習データの収集と評価 |
The challenge
このプログラムの既存のチャットボットのプロトタイプは英語でしか機能せず、対象とすべき人口の大部分が除外されていました。また、必要な現地語にわたって、必要な量で本物のネイティブスピーカーによる対応を示せる既存のベンダーはありませんでした。
The approach
Jwumaは、必要な現地語にわたってネイティブスピーカーのコントリビューターを募集し、代表的な市民の質問の例を作成して、各言語でのチャットボットの回答の正確さと適切さを評価しました。回答の品質の判断で意見が分かれたり曖昧だったりした場合は、レビューをエスカレーションしました。
Results
このプログラムは、チャットボットが実際に機能する言語の対応範囲を、サービス対象の人口が最も多く話す現地語まで広げ、自分の言語でサービスを使える人を大きく増やしました。
Frequently asked questions
公共部門のAIサービスに、特にその土地の言語の学習データが必要なのはなぜですか?
国の公用語や行政用語でしか機能しない市民サービスのチャットボットは、日常的に他の現地語を話す人口の大部分を除外してしまうためです。
Jwumaは、あまり対応されていない言語のネイティブスピーカーをどのように確保しますか?
バイリンガルの仲介者に頼らず、それらの言語が話される地域内で、検証済みのコントリビューターを直接募集することによります。
プログラムが拡大するにつれて、この方法を追加の言語にも広げられますか?
はい。追加する対象言語のネイティブスピーカーのコントリビューターネットワークが存在するか、構築できる場合は可能です。
Related case studies
世界的なモビリティプラットフォーム向けの顔・本人確認データ
世界的なモビリティ・ライドシェアのプラットフォームが、ドライバーと乗客の安全確認システムを強化するため、厳格な同意と生体情報の取り扱い要件のもとで、複数の地域にわたる検証済みの顔と本人確認のデータを必要としていました。
ロボティクスAIプログラム向けのエゴセントリック動画データ収集
あるロボティクスAI企業は、身体性を持つAIモデルが単一の研究室の環境を超えて汎化できるように学習させるため、多様な環境と体型で一貫して撮影された、人間が日常の物理的な作業を行う一人称視点の動画を必要としていました。
対話型AIモデルのRLHF評価
ある対話型AI企業は、既存の場当たり的な評価者のプールが一貫性のない採点を生んだことから、RLHFのファインチューニングのプロセスでチャットボットの回答品質を評価するための、構造化され拡張可能な人間による評価パイプラインを必要としていました。
Published 2026-10-02 by Jwuma, operated by Corpshore AI. This case study is an anonymized composite representative of the kind of work Jwuma performs in this industry, described by industry, region and engagement type rather than by company name, since this engagement is not yet cleared for public naming. Discuss a similar program at client.corpshore.ai.