FEDERAÇÃO NACIONAL DOS TRABALHADORES EM TECNOLOGIA DA INFORMAÇÃO

A FEDERAÇÃO DE TI QUE MAIS CRESCE NO BRASIL!

IAs apresentam falhas e inconsistências na moderação de discurso de ódio

Análise comparativa mostra que principais modelos de linguagem divergem nas classificações de um mesmo conteúdo
IAs apresentam falhas e inconsistências na moderação de discurso de ódio
IAs apresentam falhas e inconsistências na moderação de discurso de ódio

Discurso de ódio – Com a expansão do discurso de ódio nas redes sociais, empresas de tecnologia têm recorrido a modelos de inteligência artificial para filtrar automaticamente conteúdos nocivos. No entanto, um estudo publicado no ACL Anthology revela que esses sistemas ainda apresentam falhas significativas.

Pesquisadores da Escola de Comunicação Annenberg realizaram a primeira avaliação comparativa em larga escala de sete modelos de IA usados na moderação, entre eles sistemas da OpenAI, Mistral, Claude 3.5 Sonnet, DeepSeek V3 e Google Perspective.

LEIA: Ação judicial contra a Uber acusa empresa de discriminação contra PCDs

O experimento analisou 1,3 milhão de frases sintéticas envolvendo 125 grupos sociais, formuladas em diferentes contextos, desde termos neutros e positivos até insultos.

Principais conclusões do experimento

• Classificações divergentes para o mesmo conteúdo: modelos distintos deram respostas opostas a textos idênticos, com alguns sinalizando-os como ofensivos e outros os aceitando, o que pode gerar a percepção de viés e comprometer a confiança pública.
• Sensibilidade desigual a certos grupos: enquanto alguns sistemas mantêm maior consistência, outros apresentaram variações mais marcantes, sobretudo em frases relacionadas a escolaridade, interesses pessoais e classe econômica, expondo determinados públicos a maior vulnerabilidade.
• Tratamento inconsistente de frases neutras e positivas: modelos como Claude 3.5 Sonnet e Mistral marcaram insultos como prejudiciais de forma categórica, independentemente do contexto, enquanto outros consideraram a intenção, revelando a ausência de um padrão intermediário.

Segundo os pesquisadores, essas discrepâncias reforçam os dilemas da moderação automatizada: encontrar equilíbrio entre precisão e excesso de restrição. O estudo conclui que, apesar dos avanços, as ferramentas de IA ainda têm limitações significativas para lidar de forma justa e confiável com o discurso de ódio online.

(Com informações de Olhar Digital)
(Foto: Reprodução/Freepik/user8285578)

Mais recentes

Telescópio Roman inicia nova fase de testes antes de investigar exoplanetas e galáxias

Telescópio Roman inicia nova fase de testes antes de investigar exoplanetas e galáxias

Trabalhadores da Neospace aprovam acordo de PLR 2026

Trabalhadores da Neospace aprovam acordo de PLR 2026

‘Casada’ com IA, mulher de Curitiba busca corpo robótico para materializar o ‘marido’

‘Casada’ com IA, mulher de Curitiba busca corpo robótico para materializar o ‘marido’

Camundongos ganham cérebro humano para estudo de doenças neurológicas

Camundongos ganham cérebro humano para estudo de doenças neurológicas

Idoso perde R$ 52 mil em golpe com advogada e desembargador falsos em MS

Idoso perde R$ 52 mil em golpe com advogada e desembargador falsos em MS

Volta ao presencial prejudica cidades do interior e faz trabalhadores pensarem em mudança de emprego

Volta ao presencial prejudica cidades do interior e faz trabalhadores pensarem em mudança de emprego

3 coisas para analisar antes de se aplicar a uma vaga de emprego – e uma ferramenta que faz isso por você

3 coisas para analisar antes de se aplicar a uma vaga de emprego – e uma ferramenta que faz isso por você

Agente de IA ataca sistema de empresa de forma autônoma na Espanha

Agente de IA ataca sistema de empresa de forma autônoma na Espanha

IA e golpes via Pix colocam Brasil em top 3 de ataques digitais no mundo

IA e golpes via Pix colocam Brasil em top 3 de ataques digitais no mundo

Brasil cria política para fortalecer cadeia de minérios críticos para a tecnologia

Brasil cria política para fortalecer cadeia de minérios críticos para a tecnologia

Google Cloud quer capacitar 200 mil pessoas em IA em um dia no Brasil

Google Cloud quer capacitar 200 mil pessoas em IA em um dia no Brasil

Licenciamento de data center do TikTok no Brasil é questionado por entidades

Licenciamento de data center do TikTok no Brasil é questionado por entidades

Nova regra para VR e VA entra em vigor em novembro; entenda as mudanças

Nova regra para VR e VA entra em vigor em novembro; entenda as mudanças

Brasileiros querem se aposentar até os 60, mas regras e renda dificultam planos

Brasileiros querem se aposentar até os 60, mas regras e renda dificultam planos

Radar de alta tecnologia será instalado em Pontal do Paraná para monitorar chuvas

Radar de alta tecnologia será instalado em Pontal do Paraná para monitorar chuvas