Dados de treino multilingues para um chatbot de serviços aos cidadãos num programa de IA governamental
Uma iniciativa de serviços digitais do setor público precisava de dados de treino em várias línguas locais para lançar um chatbot de serviços aos cidadãos capaz de responder a perguntas comuns sobre serviços públicos nas línguas que os residentes realmente falavam.
Client snapshot
| Industry | Serviços digitais governamentais e do setor público |
|---|---|
| Region | África Ocidental |
| Engagement type | Recolha e avaliação de dados de treino conversacionais multilingues |
The challenge
O protótipo de chatbot existente do programa funcionava apenas em inglês, o que excluía uma grande parte da população que se destinava a servir, e nenhum fornecedor existente conseguia demonstrar uma cobertura genuína de falantes nativos nas línguas locais exigidas ao volume necessário.
The approach
A Jwuma recrutou colaboradores falantes nativos nas línguas locais exigidas para gerar exemplos representativos de perguntas de cidadãos e avaliar a exatidão e a adequação das respostas do chatbot em cada língua, com escalada de revisão para juízos contestados ou ambíguos sobre a qualidade das respostas.
Results
O programa alargou a cobertura linguística funcional do seu chatbot de modo a incluir as línguas locais mais faladas pela população que servia, ampliando de forma significativa quem podia usar o serviço na sua própria língua.
Frequently asked questions
Porque é que os serviços de IA do setor público precisam especificamente de dados de treino em língua materna?
Porque os chatbots de serviços aos cidadãos que funcionam apenas na língua oficial ou administrativa de um país excluem grandes partes da população que fala outras línguas locais no dia a dia.
Como obtém a Jwuma falantes nativos para línguas menos apoiadas?
Através do recrutamento de colaboradores verificados diretamente nas regiões onde essas línguas são faladas, em vez de recorrer a intermediários bilingues.
Esta abordagem pode estender-se a línguas adicionais à medida que um programa se expande?
Sim, desde que existam ou possam ser criadas redes de colaboradores falantes nativos para as línguas-alvo adicionais.
Related case studies
Dados de verificação facial e de identidade para uma plataforma global de mobilidade
Uma plataforma global de mobilidade e de transporte individual precisava de dados faciais e de identidade verificados em várias regiões para reforçar um sistema de verificação de segurança de condutores e passageiros, sob requisitos rigorosos de consentimento e de tratamento de dados biométricos.
Recolha de dados de vídeo egocêntrico para um programa de IA de robótica
Uma empresa de IA de robótica precisava de vídeo na primeira pessoa de humanos a realizar tarefas físicas do quotidiano, captado de forma consistente em ambientes e tipos de corpo diversos, para treinar um modelo de IA incorporada a generalizar para além de um único cenário de laboratório.
Avaliação de RLHF para um modelo de IA conversacional
Uma empresa de IA conversacional precisava de um pipeline de avaliação humana estruturado e escalável para avaliar a qualidade das respostas de chatbot no seu processo de ajuste fino por RLHF, depois de o seu conjunto de avaliadores ad hoc existente ter produzido pontuações inconsistentes.
Published 2026-10-02 by Jwuma, operated by Corpshore AI. This case study is an anonymized composite representative of the kind of work Jwuma performs in this industry, described by industry, region and engagement type rather than by company name, since this engagement is not yet cleared for public naming. Discuss a similar program at client.corpshore.ai.