Resources / Case Studies

政府 AI 项目的多语言市民服务聊天机器人训练数据

一个公共部门数字服务项目需要多种本地语言的训练数据,以推出一款市民服务聊天机器人,能够用居民实际使用的语言回答常见的政府服务问题。

Client snapshot

Industry政府与公共部门数字服务
Region西非
Engagement type多语言对话训练数据的收集与评估

The challenge

该项目现有的聊天机器人原型只能使用英语,这把它所要服务的很大一部分人口排除在外,而且没有任何现有供应商能够证明,在所需的数量上,对所需本地语言有真正的母语者覆盖。

The approach

Jwuma 在所需的本地语言中招募了母语者贡献者,生成具有代表性的市民提问示例,并评估每种语言中聊天机器人回答的准确性和得体性,对有争议或含糊的回答质量判断实行审核上报。

Results

该项目将其聊天机器人的实际语言覆盖扩展到其所服务人口最常说的本地语言,显著扩大了可以用自己的语言使用该服务的人群。

Frequently asked questions

为什么公共部门的 AI 服务特别需要母语的训练数据?

因为只用一个国家的官方语言或行政语言的市民服务聊天机器人,会把日常说其他本地语言的大部分人口排除在外。

Jwuma 如何为较少获得支持的语言寻找母语者?

通过直接在使用这些语言的地区内招募经过验证的贡献者,而不是依赖双语中间人。

随着项目扩大,这种方法可以扩展到更多语言吗?

可以,前提是针对新增的目标语言已有或可以建立母语者贡献者网络。

探讨公共部门语言数据项目 →

Published 2026-10-02 by Jwuma, operated by Corpshore AI. This case study is an anonymized composite representative of the kind of work Jwuma performs in this industry, described by industry, region and engagement type rather than by company name, since this engagement is not yet cleared for public naming. Discuss a similar program at client.corpshore.ai.