Metodologia para detecção de noticias falsas usando rotulo de vies politico
| Ano de defesa: | 2024 |
|---|---|
| Autor(a) principal: | |
| Orientador(a): | |
| Banca de defesa: | |
| Tipo de documento: | Dissertação |
| Tipo de acesso: | Acesso aberto |
| Idioma: | por |
| Instituição de defesa: |
Universidade Federal de Pernambuco
UFPE Brasil Programa de Pos Graduacao em Ciencia da Computacao |
| Programa de Pós-Graduação: |
Não Informado pela instituição
|
| Departamento: |
Não Informado pela instituição
|
| País: |
Não Informado pela instituição
|
| Palavras-chave em Português: | |
| Link de acesso: | https://repositorio.ufpe.br/handle/123456789/64520 |
Resumo: | A proliferação de notícias falsas se tornou um dos grandes dilemas da atualidade. Com a pro- pagação em massa de material desinformativo em contextos eleitorais, o debate acerca de como o viés político impacta na produção e disseminação de fake news tem crescido. Por conta da grande quantidade de postagens e textos veiculados nos meios digitais, soluções de classifi- cação automatizadas têm ganhado destaque. Grande parte das abordagens estabelecidas na literatura realizam o processamento e análise apenas do texto das notícias, ou de outras peças de mídia como imagens ou vídeos, desconsiderando que, em diversos contextos, a desinfor- mação é associada a questões políticas de modo a induzir indivíduos a determinada opinião. Tendo em vista que o viés influencia nos processos de captação, redação e edição da notícia, há, então, uma escolha de palavras direcionada pelo viés por parte dos redatores das notícias falsas. Nesse sentido, este estudo visa avaliar como a incorporação do viés político em modelos de classificação pode contribuir na detecção de notícias falsas. Para isso, foi adotada uma me- todologia para incutir o rótulo de viés aos textos correspondentes, a partir da concatenação das bases de notícias com a base de rótulos de viés extraídos de portais. Desse modo, foram com- parados três cenários: um cenário em que apenas o texto é avaliado, um cenário em que apenas o rótulo do viés é avaliado e um cenário em que o texto é concatenado com o rótulo do viés. Em cada um dos cenários, foram utilizados sete algoritmos de aprendizagem de máquina e três extratores de características em três bases de fake news distintas. Constatou-se uma melhora significativa às abordagens tradicionais, com aumento de até 29,28% na acurácia e de 50,72% no F1-Score dos modelos a partir da rotulação, com a proposta tendo apresentado os melhores índices na maioria dos experimentos avaliados, indicando que o viés político pode ser um fator importante no processo de classificação de notícias falsas. Os resultados também apontam para o classificador Support Vector Machine (SVM) e para o extrator de características LLAMA 2 como aqueles que obtiveram melhor desempenho, além da proposta se mostrar eficiente tanto para o texto, quanto para o título da notícia. |
| id |
UFPE_f47b50f5b97845a9be2c26a9fbdf7e8d |
|---|---|
| oai_identifier_str |
oai:repositorio.ufpe.br:123456789/64520 |
| network_acronym_str |
UFPE |
| network_name_str |
Repositório Institucional da UFPE |
| repository_id_str |
|
| spelling |
Metodologia para detecção de noticias falsas usando rotulo de vies politicoNoticias falsasAvaliação de classificadoresProcessamento de linguagem naturalVies politicoA proliferação de notícias falsas se tornou um dos grandes dilemas da atualidade. Com a pro- pagação em massa de material desinformativo em contextos eleitorais, o debate acerca de como o viés político impacta na produção e disseminação de fake news tem crescido. Por conta da grande quantidade de postagens e textos veiculados nos meios digitais, soluções de classifi- cação automatizadas têm ganhado destaque. Grande parte das abordagens estabelecidas na literatura realizam o processamento e análise apenas do texto das notícias, ou de outras peças de mídia como imagens ou vídeos, desconsiderando que, em diversos contextos, a desinfor- mação é associada a questões políticas de modo a induzir indivíduos a determinada opinião. Tendo em vista que o viés influencia nos processos de captação, redação e edição da notícia, há, então, uma escolha de palavras direcionada pelo viés por parte dos redatores das notícias falsas. Nesse sentido, este estudo visa avaliar como a incorporação do viés político em modelos de classificação pode contribuir na detecção de notícias falsas. Para isso, foi adotada uma me- todologia para incutir o rótulo de viés aos textos correspondentes, a partir da concatenação das bases de notícias com a base de rótulos de viés extraídos de portais. Desse modo, foram com- parados três cenários: um cenário em que apenas o texto é avaliado, um cenário em que apenas o rótulo do viés é avaliado e um cenário em que o texto é concatenado com o rótulo do viés. Em cada um dos cenários, foram utilizados sete algoritmos de aprendizagem de máquina e três extratores de características em três bases de fake news distintas. Constatou-se uma melhora significativa às abordagens tradicionais, com aumento de até 29,28% na acurácia e de 50,72% no F1-Score dos modelos a partir da rotulação, com a proposta tendo apresentado os melhores índices na maioria dos experimentos avaliados, indicando que o viés político pode ser um fator importante no processo de classificação de notícias falsas. Os resultados também apontam para o classificador Support Vector Machine (SVM) e para o extrator de características LLAMA 2 como aqueles que obtiveram melhor desempenho, além da proposta se mostrar eficiente tanto para o texto, quanto para o título da notícia.The proliferation of fake news has become one of the great dilemmas of the present time. With the mass spread of disinformative material in electoral contexts, the debate surrounding how political bias impacts the production and dissemination of fake news has grown. Due to the large amount of posts and texts circulating in digital media, automated classification solutions have gained prominence. Most of the approaches established in the literature only process and analyze the text of the news or other media pieces, such as images or videos, disregarding that, in many contexts, disinformation is associated with political issues to induce individuals toward a particular opinion. Given that bias influences the processes of gathering, writing and editing news, there is a biased word choice by the authors of fake news. In this sense, this study aims to evaluate how the incorporation of political bias into classification models can contribute to the detection of fake news. For this, a methodology was adopted to incorporate bias labels into the corresponding texts by merging the news datasets with the bias label dataset extracted from portals. Thus, three scenarios were compared: a scenario in which only the text is evaluated, a scenario in which only the bias label is evaluated, and a scenario in which the text is concatenated with the bias label. In each of the scenarios, seven machine learning algorithms and three feature extractors were used across three distinct fake news datasets. A significant improvement was observed compared to traditional approaches, with an increase of up to 29.28% in accuracy and 50.72% in the F1-Score of the models using bias labeling. The proposed method showed the best performance in most of the evaluated experiments, indicating that political bias can be an important factor in the process of classifying fake news. The results also point to the Support Vector Machine (SVM) classifier and the LLAMA 2 feature extractor as the ones that achieved the best performance. Furthermore, the proposed method proved to be efficient for both the text and the title of the news.Universidade Federal de PernambucoUFPEBrasilPrograma de Pos Graduacao em Ciencia da ComputacaoCAVALCANTI, George Darmiton da CunhaNASCIMENTO, Francimaria Rayanne dos Santoshttp://lattes.cnpq.br/8129123583622787http://lattes.cnpq.br/8577312109146354http://lattes.cnpq.br/3241407043892610LISBOA, Lucas Albuquerque2025-07-21T12:18:03Z2025-07-21T12:18:03Z2024-10-29info:eu-repo/semantics/publishedVersioninfo:eu-repo/semantics/masterThesisapplication/pdfhttps://repositorio.ufpe.br/handle/123456789/64520porhttps://creativecommons.org/licenses/by-nc-nd/4.0/info:eu-repo/semantics/openAccessreponame:Repositório Institucional da UFPEinstname:Universidade Federal de Pernambuco (UFPE)instacron:UFPE2025-07-27T17:50:49Zoai:repositorio.ufpe.br:123456789/64520Repositório InstitucionalPUBhttps://repositorio.ufpe.br/oai/requestattena@ufpe.bropendoar:22212025-07-27T17:50:49Repositório Institucional da UFPE - Universidade Federal de Pernambuco (UFPE)false |
| dc.title.none.fl_str_mv |
Metodologia para detecção de noticias falsas usando rotulo de vies politico |
| title |
Metodologia para detecção de noticias falsas usando rotulo de vies politico |
| spellingShingle |
Metodologia para detecção de noticias falsas usando rotulo de vies politico LISBOA, Lucas Albuquerque Noticias falsas Avaliação de classificadores Processamento de linguagem natural Vies politico |
| title_short |
Metodologia para detecção de noticias falsas usando rotulo de vies politico |
| title_full |
Metodologia para detecção de noticias falsas usando rotulo de vies politico |
| title_fullStr |
Metodologia para detecção de noticias falsas usando rotulo de vies politico |
| title_full_unstemmed |
Metodologia para detecção de noticias falsas usando rotulo de vies politico |
| title_sort |
Metodologia para detecção de noticias falsas usando rotulo de vies politico |
| author |
LISBOA, Lucas Albuquerque |
| author_facet |
LISBOA, Lucas Albuquerque |
| author_role |
author |
| dc.contributor.none.fl_str_mv |
CAVALCANTI, George Darmiton da Cunha NASCIMENTO, Francimaria Rayanne dos Santos http://lattes.cnpq.br/8129123583622787 http://lattes.cnpq.br/8577312109146354 http://lattes.cnpq.br/3241407043892610 |
| dc.contributor.author.fl_str_mv |
LISBOA, Lucas Albuquerque |
| dc.subject.por.fl_str_mv |
Noticias falsas Avaliação de classificadores Processamento de linguagem natural Vies politico |
| topic |
Noticias falsas Avaliação de classificadores Processamento de linguagem natural Vies politico |
| description |
A proliferação de notícias falsas se tornou um dos grandes dilemas da atualidade. Com a pro- pagação em massa de material desinformativo em contextos eleitorais, o debate acerca de como o viés político impacta na produção e disseminação de fake news tem crescido. Por conta da grande quantidade de postagens e textos veiculados nos meios digitais, soluções de classifi- cação automatizadas têm ganhado destaque. Grande parte das abordagens estabelecidas na literatura realizam o processamento e análise apenas do texto das notícias, ou de outras peças de mídia como imagens ou vídeos, desconsiderando que, em diversos contextos, a desinfor- mação é associada a questões políticas de modo a induzir indivíduos a determinada opinião. Tendo em vista que o viés influencia nos processos de captação, redação e edição da notícia, há, então, uma escolha de palavras direcionada pelo viés por parte dos redatores das notícias falsas. Nesse sentido, este estudo visa avaliar como a incorporação do viés político em modelos de classificação pode contribuir na detecção de notícias falsas. Para isso, foi adotada uma me- todologia para incutir o rótulo de viés aos textos correspondentes, a partir da concatenação das bases de notícias com a base de rótulos de viés extraídos de portais. Desse modo, foram com- parados três cenários: um cenário em que apenas o texto é avaliado, um cenário em que apenas o rótulo do viés é avaliado e um cenário em que o texto é concatenado com o rótulo do viés. Em cada um dos cenários, foram utilizados sete algoritmos de aprendizagem de máquina e três extratores de características em três bases de fake news distintas. Constatou-se uma melhora significativa às abordagens tradicionais, com aumento de até 29,28% na acurácia e de 50,72% no F1-Score dos modelos a partir da rotulação, com a proposta tendo apresentado os melhores índices na maioria dos experimentos avaliados, indicando que o viés político pode ser um fator importante no processo de classificação de notícias falsas. Os resultados também apontam para o classificador Support Vector Machine (SVM) e para o extrator de características LLAMA 2 como aqueles que obtiveram melhor desempenho, além da proposta se mostrar eficiente tanto para o texto, quanto para o título da notícia. |
| publishDate |
2024 |
| dc.date.none.fl_str_mv |
2024-10-29 2025-07-21T12:18:03Z 2025-07-21T12:18:03Z |
| dc.type.status.fl_str_mv |
info:eu-repo/semantics/publishedVersion |
| dc.type.driver.fl_str_mv |
info:eu-repo/semantics/masterThesis |
| format |
masterThesis |
| status_str |
publishedVersion |
| dc.identifier.uri.fl_str_mv |
https://repositorio.ufpe.br/handle/123456789/64520 |
| url |
https://repositorio.ufpe.br/handle/123456789/64520 |
| dc.language.iso.fl_str_mv |
por |
| language |
por |
| dc.rights.driver.fl_str_mv |
https://creativecommons.org/licenses/by-nc-nd/4.0/ info:eu-repo/semantics/openAccess |
| rights_invalid_str_mv |
https://creativecommons.org/licenses/by-nc-nd/4.0/ |
| eu_rights_str_mv |
openAccess |
| dc.format.none.fl_str_mv |
application/pdf |
| dc.publisher.none.fl_str_mv |
Universidade Federal de Pernambuco UFPE Brasil Programa de Pos Graduacao em Ciencia da Computacao |
| publisher.none.fl_str_mv |
Universidade Federal de Pernambuco UFPE Brasil Programa de Pos Graduacao em Ciencia da Computacao |
| dc.source.none.fl_str_mv |
reponame:Repositório Institucional da UFPE instname:Universidade Federal de Pernambuco (UFPE) instacron:UFPE |
| instname_str |
Universidade Federal de Pernambuco (UFPE) |
| instacron_str |
UFPE |
| institution |
UFPE |
| reponame_str |
Repositório Institucional da UFPE |
| collection |
Repositório Institucional da UFPE |
| repository.name.fl_str_mv |
Repositório Institucional da UFPE - Universidade Federal de Pernambuco (UFPE) |
| repository.mail.fl_str_mv |
attena@ufpe.br |
| _version_ |
1856041914270220288 |