Metodologia para detecção de noticias falsas usando rotulo de vies politico

Detalhes bibliográficos
Ano de defesa: 2024
Autor(a) principal: LISBOA, Lucas Albuquerque
Orientador(a): Não Informado pela instituição
Banca de defesa: Não Informado pela instituição
Tipo de documento: Dissertação
Tipo de acesso: Acesso aberto
Idioma: por
Instituição de defesa: Universidade Federal de Pernambuco
UFPE
Brasil
Programa de Pos Graduacao em Ciencia da Computacao
Programa de Pós-Graduação: Não Informado pela instituição
Departamento: Não Informado pela instituição
País: Não Informado pela instituição
Palavras-chave em Português:
Link de acesso: https://repositorio.ufpe.br/handle/123456789/64520
Resumo: A proliferação de notícias falsas se tornou um dos grandes dilemas da atualidade. Com a pro- pagação em massa de material desinformativo em contextos eleitorais, o debate acerca de como o viés político impacta na produção e disseminação de fake news tem crescido. Por conta da grande quantidade de postagens e textos veiculados nos meios digitais, soluções de classifi- cação automatizadas têm ganhado destaque. Grande parte das abordagens estabelecidas na literatura realizam o processamento e análise apenas do texto das notícias, ou de outras peças de mídia como imagens ou vídeos, desconsiderando que, em diversos contextos, a desinfor- mação é associada a questões políticas de modo a induzir indivíduos a determinada opinião. Tendo em vista que o viés influencia nos processos de captação, redação e edição da notícia, há, então, uma escolha de palavras direcionada pelo viés por parte dos redatores das notícias falsas. Nesse sentido, este estudo visa avaliar como a incorporação do viés político em modelos de classificação pode contribuir na detecção de notícias falsas. Para isso, foi adotada uma me- todologia para incutir o rótulo de viés aos textos correspondentes, a partir da concatenação das bases de notícias com a base de rótulos de viés extraídos de portais. Desse modo, foram com- parados três cenários: um cenário em que apenas o texto é avaliado, um cenário em que apenas o rótulo do viés é avaliado e um cenário em que o texto é concatenado com o rótulo do viés. Em cada um dos cenários, foram utilizados sete algoritmos de aprendizagem de máquina e três extratores de características em três bases de fake news distintas. Constatou-se uma melhora significativa às abordagens tradicionais, com aumento de até 29,28% na acurácia e de 50,72% no F1-Score dos modelos a partir da rotulação, com a proposta tendo apresentado os melhores índices na maioria dos experimentos avaliados, indicando que o viés político pode ser um fator importante no processo de classificação de notícias falsas. Os resultados também apontam para o classificador Support Vector Machine (SVM) e para o extrator de características LLAMA 2 como aqueles que obtiveram melhor desempenho, além da proposta se mostrar eficiente tanto para o texto, quanto para o título da notícia.
id UFPE_f47b50f5b97845a9be2c26a9fbdf7e8d
oai_identifier_str oai:repositorio.ufpe.br:123456789/64520
network_acronym_str UFPE
network_name_str Repositório Institucional da UFPE
repository_id_str
spelling Metodologia para detecção de noticias falsas usando rotulo de vies politicoNoticias falsasAvaliação de classificadoresProcessamento de linguagem naturalVies politicoA proliferação de notícias falsas se tornou um dos grandes dilemas da atualidade. Com a pro- pagação em massa de material desinformativo em contextos eleitorais, o debate acerca de como o viés político impacta na produção e disseminação de fake news tem crescido. Por conta da grande quantidade de postagens e textos veiculados nos meios digitais, soluções de classifi- cação automatizadas têm ganhado destaque. Grande parte das abordagens estabelecidas na literatura realizam o processamento e análise apenas do texto das notícias, ou de outras peças de mídia como imagens ou vídeos, desconsiderando que, em diversos contextos, a desinfor- mação é associada a questões políticas de modo a induzir indivíduos a determinada opinião. Tendo em vista que o viés influencia nos processos de captação, redação e edição da notícia, há, então, uma escolha de palavras direcionada pelo viés por parte dos redatores das notícias falsas. Nesse sentido, este estudo visa avaliar como a incorporação do viés político em modelos de classificação pode contribuir na detecção de notícias falsas. Para isso, foi adotada uma me- todologia para incutir o rótulo de viés aos textos correspondentes, a partir da concatenação das bases de notícias com a base de rótulos de viés extraídos de portais. Desse modo, foram com- parados três cenários: um cenário em que apenas o texto é avaliado, um cenário em que apenas o rótulo do viés é avaliado e um cenário em que o texto é concatenado com o rótulo do viés. Em cada um dos cenários, foram utilizados sete algoritmos de aprendizagem de máquina e três extratores de características em três bases de fake news distintas. Constatou-se uma melhora significativa às abordagens tradicionais, com aumento de até 29,28% na acurácia e de 50,72% no F1-Score dos modelos a partir da rotulação, com a proposta tendo apresentado os melhores índices na maioria dos experimentos avaliados, indicando que o viés político pode ser um fator importante no processo de classificação de notícias falsas. Os resultados também apontam para o classificador Support Vector Machine (SVM) e para o extrator de características LLAMA 2 como aqueles que obtiveram melhor desempenho, além da proposta se mostrar eficiente tanto para o texto, quanto para o título da notícia.The proliferation of fake news has become one of the great dilemmas of the present time. With the mass spread of disinformative material in electoral contexts, the debate surrounding how political bias impacts the production and dissemination of fake news has grown. Due to the large amount of posts and texts circulating in digital media, automated classification solutions have gained prominence. Most of the approaches established in the literature only process and analyze the text of the news or other media pieces, such as images or videos, disregarding that, in many contexts, disinformation is associated with political issues to induce individuals toward a particular opinion. Given that bias influences the processes of gathering, writing and editing news, there is a biased word choice by the authors of fake news. In this sense, this study aims to evaluate how the incorporation of political bias into classification models can contribute to the detection of fake news. For this, a methodology was adopted to incorporate bias labels into the corresponding texts by merging the news datasets with the bias label dataset extracted from portals. Thus, three scenarios were compared: a scenario in which only the text is evaluated, a scenario in which only the bias label is evaluated, and a scenario in which the text is concatenated with the bias label. In each of the scenarios, seven machine learning algorithms and three feature extractors were used across three distinct fake news datasets. A significant improvement was observed compared to traditional approaches, with an increase of up to 29.28% in accuracy and 50.72% in the F1-Score of the models using bias labeling. The proposed method showed the best performance in most of the evaluated experiments, indicating that political bias can be an important factor in the process of classifying fake news. The results also point to the Support Vector Machine (SVM) classifier and the LLAMA 2 feature extractor as the ones that achieved the best performance. Furthermore, the proposed method proved to be efficient for both the text and the title of the news.Universidade Federal de PernambucoUFPEBrasilPrograma de Pos Graduacao em Ciencia da ComputacaoCAVALCANTI, George Darmiton da CunhaNASCIMENTO, Francimaria Rayanne dos Santoshttp://lattes.cnpq.br/8129123583622787http://lattes.cnpq.br/8577312109146354http://lattes.cnpq.br/3241407043892610LISBOA, Lucas Albuquerque2025-07-21T12:18:03Z2025-07-21T12:18:03Z2024-10-29info:eu-repo/semantics/publishedVersioninfo:eu-repo/semantics/masterThesisapplication/pdfhttps://repositorio.ufpe.br/handle/123456789/64520porhttps://creativecommons.org/licenses/by-nc-nd/4.0/info:eu-repo/semantics/openAccessreponame:Repositório Institucional da UFPEinstname:Universidade Federal de Pernambuco (UFPE)instacron:UFPE2025-07-27T17:50:49Zoai:repositorio.ufpe.br:123456789/64520Repositório InstitucionalPUBhttps://repositorio.ufpe.br/oai/requestattena@ufpe.bropendoar:22212025-07-27T17:50:49Repositório Institucional da UFPE - Universidade Federal de Pernambuco (UFPE)false
dc.title.none.fl_str_mv Metodologia para detecção de noticias falsas usando rotulo de vies politico
title Metodologia para detecção de noticias falsas usando rotulo de vies politico
spellingShingle Metodologia para detecção de noticias falsas usando rotulo de vies politico
LISBOA, Lucas Albuquerque
Noticias falsas
Avaliação de classificadores
Processamento de linguagem natural
Vies politico
title_short Metodologia para detecção de noticias falsas usando rotulo de vies politico
title_full Metodologia para detecção de noticias falsas usando rotulo de vies politico
title_fullStr Metodologia para detecção de noticias falsas usando rotulo de vies politico
title_full_unstemmed Metodologia para detecção de noticias falsas usando rotulo de vies politico
title_sort Metodologia para detecção de noticias falsas usando rotulo de vies politico
author LISBOA, Lucas Albuquerque
author_facet LISBOA, Lucas Albuquerque
author_role author
dc.contributor.none.fl_str_mv CAVALCANTI, George Darmiton da Cunha
NASCIMENTO, Francimaria Rayanne dos Santos
http://lattes.cnpq.br/8129123583622787
http://lattes.cnpq.br/8577312109146354
http://lattes.cnpq.br/3241407043892610
dc.contributor.author.fl_str_mv LISBOA, Lucas Albuquerque
dc.subject.por.fl_str_mv Noticias falsas
Avaliação de classificadores
Processamento de linguagem natural
Vies politico
topic Noticias falsas
Avaliação de classificadores
Processamento de linguagem natural
Vies politico
description A proliferação de notícias falsas se tornou um dos grandes dilemas da atualidade. Com a pro- pagação em massa de material desinformativo em contextos eleitorais, o debate acerca de como o viés político impacta na produção e disseminação de fake news tem crescido. Por conta da grande quantidade de postagens e textos veiculados nos meios digitais, soluções de classifi- cação automatizadas têm ganhado destaque. Grande parte das abordagens estabelecidas na literatura realizam o processamento e análise apenas do texto das notícias, ou de outras peças de mídia como imagens ou vídeos, desconsiderando que, em diversos contextos, a desinfor- mação é associada a questões políticas de modo a induzir indivíduos a determinada opinião. Tendo em vista que o viés influencia nos processos de captação, redação e edição da notícia, há, então, uma escolha de palavras direcionada pelo viés por parte dos redatores das notícias falsas. Nesse sentido, este estudo visa avaliar como a incorporação do viés político em modelos de classificação pode contribuir na detecção de notícias falsas. Para isso, foi adotada uma me- todologia para incutir o rótulo de viés aos textos correspondentes, a partir da concatenação das bases de notícias com a base de rótulos de viés extraídos de portais. Desse modo, foram com- parados três cenários: um cenário em que apenas o texto é avaliado, um cenário em que apenas o rótulo do viés é avaliado e um cenário em que o texto é concatenado com o rótulo do viés. Em cada um dos cenários, foram utilizados sete algoritmos de aprendizagem de máquina e três extratores de características em três bases de fake news distintas. Constatou-se uma melhora significativa às abordagens tradicionais, com aumento de até 29,28% na acurácia e de 50,72% no F1-Score dos modelos a partir da rotulação, com a proposta tendo apresentado os melhores índices na maioria dos experimentos avaliados, indicando que o viés político pode ser um fator importante no processo de classificação de notícias falsas. Os resultados também apontam para o classificador Support Vector Machine (SVM) e para o extrator de características LLAMA 2 como aqueles que obtiveram melhor desempenho, além da proposta se mostrar eficiente tanto para o texto, quanto para o título da notícia.
publishDate 2024
dc.date.none.fl_str_mv 2024-10-29
2025-07-21T12:18:03Z
2025-07-21T12:18:03Z
dc.type.status.fl_str_mv info:eu-repo/semantics/publishedVersion
dc.type.driver.fl_str_mv info:eu-repo/semantics/masterThesis
format masterThesis
status_str publishedVersion
dc.identifier.uri.fl_str_mv https://repositorio.ufpe.br/handle/123456789/64520
url https://repositorio.ufpe.br/handle/123456789/64520
dc.language.iso.fl_str_mv por
language por
dc.rights.driver.fl_str_mv https://creativecommons.org/licenses/by-nc-nd/4.0/
info:eu-repo/semantics/openAccess
rights_invalid_str_mv https://creativecommons.org/licenses/by-nc-nd/4.0/
eu_rights_str_mv openAccess
dc.format.none.fl_str_mv application/pdf
dc.publisher.none.fl_str_mv Universidade Federal de Pernambuco
UFPE
Brasil
Programa de Pos Graduacao em Ciencia da Computacao
publisher.none.fl_str_mv Universidade Federal de Pernambuco
UFPE
Brasil
Programa de Pos Graduacao em Ciencia da Computacao
dc.source.none.fl_str_mv reponame:Repositório Institucional da UFPE
instname:Universidade Federal de Pernambuco (UFPE)
instacron:UFPE
instname_str Universidade Federal de Pernambuco (UFPE)
instacron_str UFPE
institution UFPE
reponame_str Repositório Institucional da UFPE
collection Repositório Institucional da UFPE
repository.name.fl_str_mv Repositório Institucional da UFPE - Universidade Federal de Pernambuco (UFPE)
repository.mail.fl_str_mv attena@ufpe.br
_version_ 1856041914270220288