Moderação de conteúdo e deteção de toxicidade para uma plataforma de jogos
Uma plataforma de jogos precisava de exemplos anotados de chat durante o jogo tóxico e não tóxico para treinar o seu modelo de moderação a detetar assédio e linguagem abusiva sem assinalar em excesso a troca de palavras normal da competição.
Client snapshot
| Industry | Jogos em linha e entretenimento interativo |
|---|---|
| Region | Global, com colaboradores associados às principais línguas dos jogadores da plataforma |
| Engagement type | Anotação de toxicidade e assédio para moderação do chat durante o jogo |
The challenge
O modelo de moderação existente do cliente tinha dificuldade em distinguir a linguagem genuinamente nociva da gíria e da troca de palavras competitiva dos jogos, produzindo tanto assédio não detetado como assinalamentos de falsos positivos que frustravam os jogadores.
The approach
A Jwuma atribuiu anotadores familiarizados com as convenções de linguagem da comunidade de jogos para etiquetar exemplos de chat segundo uma taxonomia de toxicidade detalhada que distingue o assédio genuíno da troca de palavras competitiva, com os exemplos contestados ou limítrofes escalados através de um nível de revisão.
Results
O modelo de moderação retreinado do cliente mostrou uma melhor separação entre o assédio genuíno e o chat competitivo normal, reduzindo tanto as violações não detetadas como os assinalamentos de falsos positivos de jogadores no seu conjunto de avaliação.
Frequently asked questions
Porque é que a moderação do chat de jogos é mais difícil do que a moderação de conteúdo geral?
Porque as comunidades de jogos competitivos usam linguagem agressiva e gíria que, fora de contexto, pode assemelhar-se a assédio, exigindo anotadores familiarizados com essas convenções para etiquetar com exatidão.
Como reduz a Jwuma os falsos positivos nos dados de treino de deteção de toxicidade?
Usando uma taxonomia detalhada que distingue explicitamente o assédio genuíno da troca de palavras competitiva, com os casos ambíguos escalados para um nível de revisão em vez de serem assinalados por defeito.
Esta abordagem pode abranger vários títulos de jogos ou línguas?
Sim, desde que os anotadores sejam adequados às convenções da comunidade do jogo específico e às línguas-alvo de cada título.
Related case studies
Dados de verificação facial e de identidade para uma plataforma global de mobilidade
Uma plataforma global de mobilidade e de transporte individual precisava de dados faciais e de identidade verificados em várias regiões para reforçar um sistema de verificação de segurança de condutores e passageiros, sob requisitos rigorosos de consentimento e de tratamento de dados biométricos.
Recolha de dados de vídeo egocêntrico para um programa de IA de robótica
Uma empresa de IA de robótica precisava de vídeo na primeira pessoa de humanos a realizar tarefas físicas do quotidiano, captado de forma consistente em ambientes e tipos de corpo diversos, para treinar um modelo de IA incorporada a generalizar para além de um único cenário de laboratório.
Avaliação de RLHF para um modelo de IA conversacional
Uma empresa de IA conversacional precisava de um pipeline de avaliação humana estruturado e escalável para avaliar a qualidade das respostas de chatbot no seu processo de ajuste fino por RLHF, depois de o seu conjunto de avaliadores ad hoc existente ter produzido pontuações inconsistentes.
Published 2026-10-02 by Jwuma, operated by Corpshore AI. This case study is an anonymized composite representative of the kind of work Jwuma performs in this industry, described by industry, region and engagement type rather than by company name, since this engagement is not yet cleared for public naming. Discuss a similar program at client.corpshore.ai.