Dati di addestramento multilingue per un chatbot di servizi ai cittadini in un programma di IA governativo
Un'iniziativa di servizi digitali del settore pubblico aveva bisogno di dati di addestramento in diverse lingue locali per lanciare un chatbot di servizi ai cittadini in grado di rispondere alle domande più comuni sui servizi pubblici nelle lingue che i residenti parlano davvero.
Client snapshot
| Industry | Servizi digitali del governo e del settore pubblico |
|---|---|
| Region | Africa occidentale |
| Engagement type | Raccolta e valutazione di dati di addestramento conversazionali multilingue |
The challenge
Il prototipo di chatbot esistente del programma funzionava solo in inglese, il che escludeva una larga parte della popolazione che avrebbe dovuto servire, e nessun fornitore esistente riusciva a dimostrare un'effettiva copertura di madrelingua nelle lingue locali richieste al volume necessario.
The approach
Jwuma ha reclutato contributor madrelingua nelle lingue locali richieste per generare esempi rappresentativi di richieste dei cittadini e per valutare accuratezza e adeguatezza delle risposte del chatbot in ciascuna lingua, con escalation della revisione per i giudizi contestati o ambigui sulla qualità delle risposte.
Results
Il programma ha esteso la copertura linguistica funzionale del proprio chatbot includendo le lingue locali più parlate dalla popolazione servita, ampliando in modo significativo chi poteva usare il servizio nella propria lingua.
Frequently asked questions
Perché i servizi di IA del settore pubblico hanno bisogno specificamente di dati di addestramento in lingua madre?
Perché i chatbot di servizi ai cittadini che funzionano solo nella lingua ufficiale o amministrativa di un paese escludono ampie fasce di popolazione che parlano quotidianamente altre lingue locali.
Come reperisce Jwuma madrelingua per le lingue supportate meno comunemente?
Tramite il reclutamento di contributor verificati direttamente nelle regioni in cui si parlano quelle lingue, anziché affidarsi a intermediari bilingui.
Questo approccio può estendersi ad altre lingue man mano che un programma si espande?
Sì, purché esistano o si possano costruire reti di contributor madrelingua per le lingue di destinazione aggiuntive.
Related case studies
Dati di verifica facciale e dell'identità per una piattaforma di mobilità globale
Una piattaforma globale di mobilità e ride-hailing aveva bisogno di dati verificati di volti e identità in più regioni per rafforzare un sistema di verifica della sicurezza di autisti e passeggeri, nel rispetto di rigorosi requisiti di consenso e di trattamento dei dati biometrici.
Raccolta di dati video egocentrici per un programma di IA robotica
Un'azienda di IA robotica aveva bisogno di video in prima persona di persone che svolgono compiti fisici quotidiani, acquisiti in modo coerente in ambienti e con tipi di corpo diversi, per addestrare un modello di IA incarnata a generalizzare oltre un singolo ambiente di laboratorio.
Valutazione RLHF per un modello di IA conversazionale
Un'azienda di IA conversazionale aveva bisogno di una pipeline di valutazione umana strutturata e scalabile per valutare la qualità delle risposte dei chatbot nel proprio processo di messa a punto RLHF, dopo che il suo gruppo di valutatori ad hoc aveva prodotto punteggi incoerenti.
Published 2026-10-02 by Jwuma, operated by Corpshore AI. This case study is an anonymized composite representative of the kind of work Jwuma performs in this industry, described by industry, region and engagement type rather than by company name, since this engagement is not yet cleared for public naming. Discuss a similar program at client.corpshore.ai.