Defesa de Dissertação de Mestrado de Naoki Teixeira Yokoyama, 14/09/2026, 15h, por videoconferência

Hyperdimensional Computing para Detecção de Fake News: Uma Abordagem de Alta Eficiência em Dados de Larga Escala               

 

Resumo:

 

A disseminação massiva de desinformação em ambientes digitais, intensificada durante a pandemia de COVID-19, evidenciou a necessidade de sistemas automatizados de detecção de fake news capazes de operar em larga escala. Entretanto, o estado da arte da área tem sido dominado por arquiteturas baseadas em Deep Learning, Transformers e Large Language Models (LLMs), que apresentam elevado custo computacional, alto consumo energético e limitada aplicabilidade em cenários de borda. Diante desse contexto, esta dissertação investiga a viabilidade da Computação Hiperdimensional (Hyperdimensional Computing – HDC) como paradigma alternativo, fundamentado em vetores de alta dimensão e operações algébricas leves, sob a perspectiva do trade-off entre acurácia preditiva e eficiência energética. A pesquisa adota abordagem quantitativa-experimental e avalia o desempenho de cinco variantes de HDC (Vanilla HDC, AdaptHD, OnlineHD, NeuralHD e DistHD) frente a modelos de referência de Aprendizado de Máquina clássico (Logistic Regression, SVM, Random Forest, Árvore de Decisão e KNN) e ao estado da arte em Transformers (BERT e RoBERTa), em três benchmarks consolidados: ISOT Fake News Dataset, COVID-19 Fake News Dataset e FEVER Dataset, totalizando 160.051 instâncias processadas. Os resultados demonstram que, embora os Transformers preservem vantagem em acurácia (até 99,79% no ISOT e 91,47% no COVID), os modelos HDC operam com complexidade linear de treinamento, mantêm desempenho competitivo no cenário balanceado (até 95,56% no ISOT) e oferecem reduções de consumo energético entre 18× e mais de 1.100× em relação ao BERT, conforme o cenário avaliado, evidenciando trade-off favorável para cenários de Big Data, Edge Computing e Green AI. Conclui-se que a álgebra hiperdimensional não substitui os Transformers em precisão absoluta, mas constitui alternativa eficiente e sustentável para triagem em larga escala de desinformação, sobretudo em ambientes com restrição de recursos computacionais.

 

Abstract:

 

The massive dissemination of misinformation in digital environments, intensified during the COVID-19 pandemic, highlighted the need for automated fake news detection systems capable of operating at large scale. However, the current state of the art has been dominated by Deep Learning, Transformer, and Large Language Model (LLM) architectures, which entail high computational cost, significant energy consumption, and limited applicability in edge computing scenarios. In this context, this dissertation investigates the feasibility of Hyperdimensional Computing (HDC) as an alternative paradigm grounded in high-dimensional vector representations and lightweight algebraic operations, framed as a trade-off between predictive accuracy and energy efficiency. The research adopts a quantitative-experimental approach and evaluates the performance of five HDC variants (Vanilla HDC, AdaptHD, OnlineHD, NeuralHD, and DistHD) against classical Machine Learning baselines (Logistic Regression, SVM, Random Forest, Decision Tree, and KNN) and state-of-the-art Transformers (BERT and RoBERTa), across three consolidated benchmarks: the ISOT Fake News Dataset, the COVID-19 Fake News Dataset, and the FEVER Dataset, totaling 160,051 processed instances. Results show that, although Transformers retain an accuracy advantage (up to 99.79% on ISOT and 91.47% on COVID), HDC models exhibit linear training complexity, achieve competitive performance on the balanced scenario (up to 95.56% on ISOT), and deliver energy savings ranging from 18× to over 1,100× compared to BERT, depending on the evaluated scenario, indicating a favorable trade-off for Big Data, Edge Computing, and Green AI scenarios. It is concluded that hyperdimensional algebra does not replace Transformers in absolute precision, but constitutes an efficient and sustainable alternative for large-scale misinformation triage, particularly in resource-constrained environments.

 

Banca  examinadora:

 

Prof. Leandro Santiago de Araújo, UFF

Profa. Aline Marins Paes Carvalho, UFF

Prof. Leopoldo André Dutra Lusquino Filho, UNESP

Related Posts