Resources / Case Studies

Classificação de conteúdo nocivo de confiança e segurança para uma plataforma de redes sociais

Uma plataforma de redes sociais precisava de conteúdo nocivo classificado de forma consistente em várias línguas para treinar o seu modelo de confiança e segurança, depois de uma cobertura desigual ter deixado alguns dos seus mercados de língua não inglesa significativamente sub-moderados.

Client snapshot

IndustryRedes sociais e plataformas de conteúdo
RegionGlobal, concentrado nos mercados de língua não inglesa de crescimento mais rápido do cliente
Engagement typeClassificação multilingue de conteúdo nocivo para confiança e segurança

The challenge

O modelo de moderação do cliente tinha bom desempenho em inglês, mas tinha uma cobertura significativamente mais fraca em vários dos seus mercados de crescimento mais rápido, onde o conteúdo nocivo era mais difícil de detetar e, quando não detetado, acarretava um risco desproporcionado para a plataforma.

The approach

A Jwuma atribuiu anotadores falantes nativos nas línguas prioritárias do cliente para classificar conteúdo segundo uma taxonomia de danos detalhada, com as classificações contestadas ou limítrofes escaladas através de um nível de revisão e com calibração por tarefas de referência (gold tasks) para monitorizar a consistência da classificação entre línguas.

Results

O cliente alargou a cobertura consistente de classificação de conteúdo nocivo a mercados que antes estavam significativamente sub-moderados, colmatando uma lacuna importante na sua cobertura de confiança e segurança.

Frequently asked questions

Porque é que a classificação multilingue de conteúdo nocivo é mais difícil do que a moderação apenas em inglês?

Porque o conteúdo nocivo assenta muitas vezes em gíria local, contexto cultural e linguagem codificada que um modelo treinado sobretudo com dados em inglês não detetará de forma fiável.

Como mantém a Jwuma a consistência da classificação em muitas línguas?

Através de uma taxonomia de danos partilhada, aplicada por anotadores falantes nativos em cada língua, com calibração por tarefas de referência a monitorizar a consistência em todo o conjunto de anotadores.

O que acontece quando uma classificação de conteúdo é contestada ou pouco clara?

É escalada através da escada de revisão em vários níveis da Jwuma, em vez de depender do juízo de um único anotador, dado o risco para a plataforma de uma decisão incorreta.

Discuta um programa de confiança e segurança →

Published 2026-10-02 by Jwuma, operated by Corpshore AI. This case study is an anonymized composite representative of the kind of work Jwuma performs in this industry, described by industry, region and engagement type rather than by company name, since this engagement is not yet cleared for public naming. Discuss a similar program at client.corpshore.ai.