Resources / Case Studies

Classificazione di contenuti dannosi per trust e safety di una piattaforma social

Una piattaforma social aveva bisogno di una classificazione coerente dei contenuti dannosi in diverse lingue per addestrare il proprio modello di trust e safety, dopo che una copertura disomogenea aveva lasciato alcuni dei suoi mercati non anglofoni significativamente sotto-moderati.

Client snapshot

IndustrySocial media e piattaforme di contenuti
RegionGlobale, concentrato nei mercati non anglofoni a più rapida crescita del cliente
Engagement typeClassificazione multilingue di contenuti dannosi per trust e safety

The challenge

Il modello di moderazione del cliente funzionava bene in inglese ma aveva una copertura sensibilmente più debole in diversi dei suoi mercati a più rapida crescita, dove i contenuti dannosi erano più difficili da individuare e, se non rilevati, comportavano un rischio sproporzionato per la piattaforma.

The approach

Jwuma ha assegnato annotatori madrelingua nelle lingue prioritarie del cliente per classificare i contenuti in base a una tassonomia dettagliata dei danni, con le classificazioni contestate o borderline inoltrate tramite un livello di revisione e una calibrazione con gold task usata per monitorare la coerenza della classificazione tra le lingue.

Results

Il cliente ha esteso una classificazione coerente dei contenuti dannosi a mercati che prima erano significativamente sotto-moderati, colmando una lacuna importante nella propria copertura di trust e safety.

Frequently asked questions

Perché la classificazione multilingue dei contenuti dannosi è più difficile della moderazione solo in inglese?

Perché i contenuti dannosi si basano spesso su gergo locale, contesto culturale e linguaggio in codice che un modello addestrato principalmente su dati in inglese non individuerà in modo affidabile.

Come mantiene Jwuma la coerenza della classificazione su molte lingue?

Tramite una tassonomia dei danni condivisa applicata da annotatori madrelingua in ciascuna lingua, con la calibrazione tramite gold task che monitora la coerenza sull'intero gruppo di annotatori.

Cosa succede quando la classificazione di un contenuto è contestata o poco chiara?

Viene sottoposta a escalation attraverso la scala di revisione su più livelli di Jwuma anziché affidarsi al giudizio di un singolo annotatore, dato il rischio per la piattaforma di una decisione sbagliata.

Discuti un programma di trust e safety →

Published 2026-10-02 by Jwuma, operated by Corpshore AI. This case study is an anonymized composite representative of the kind of work Jwuma performs in this industry, described by industry, region and engagement type rather than by company name, since this engagement is not yet cleared for public naming. Discuss a similar program at client.corpshore.ai.