Skip navigation
Use este identificador para citar ou linkar para este item: https://repositorio.ufpe.br/handle/123456789/49464

Compartilhe esta página

Registro completo de metadados
Campo DCValorIdioma
dc.contributor.advisorBARBOSA, Luciano de Andrade-
dc.contributor.authorSILVA, Johny Moreira da-
dc.date.accessioned2023-03-23T16:50:56Z-
dc.date.available2023-03-23T16:50:56Z-
dc.date.issued2023-03-02-
dc.identifier.citationSILVA, Johny Moreira da. Augmenting product knowledge graphs with subjective information. 2023. Tese (Doutorado em Ciência da Computação) – Universidade Federal de Pernambuco, Recife, 2023.pt_BR
dc.identifier.urihttps://repositorio.ufpe.br/handle/123456789/49464-
dc.description.abstractProduct Graphs (PGs), are knowledge graphs on consumer product data. They have become popular lately due to their potential to enable AI-related tasks in e-commerce. PGs contain facts on products (e.g., mobile phones) and their characteristics (e.g., brand, dimensions, and processor) automatically gathered from several sources. Enriching these structures with dynamic and subjective information, such as users’ opinions, is essential for improving recommendations, searching, comparison, and pricing. However, this is a novel task, and works trying to handle this are based on supervised approaches. In this thesis, we address this task by exploring two complementary stages: (1) We build a weak-supervised pipeline called Product Graph enriched with Opinions (PGOpi) which augments PGs with users’ opinions extracted from product reviews. For that, we explore a traditional method for opinion mining, Distant Supervision based on word embeddings to alleviate manual labor dependency for training, and Deep Learning approaches to map extracted opinions to targets in the PG; (2) We devised SYNthetiC OPinionAted TriplEs (SYNCOPATE), a generator that autonomously builds opinionated triples and can replace traditional methods for extracting aspect-opinion pairs from opinionated reviews. We build it by exploring In-Context Learning on an adapted pretrained Language Model. Finally, we apply post-processing to clean up and label the autonomously generated text. We perform the experimental evaluation of both frameworks. We evaluated PGOpi on five product categories of two representative real-world datasets. The proposed weak-supervised approach achieves a superior micro F1 score over more complex weak-supervised models. It also presents comparable results to a fully-supervised state-ofthe-art (SOTA) model. We evaluated SYNCOPATE by augmenting existing benchmark datasets with the generated data and comparing the performance of four SOTA models on aspect-opinion pair extraction. The results show that the models trained on the generated synthetic data outperform those trained on a small percentage of human-labeled data. Furthermore, three human raters’ manual inspection of these triples attested to their quality.pt_BR
dc.description.sponsorshipCAPESpt_BR
dc.language.isoengpt_BR
dc.publisherUniversidade Federal de Pernambucopt_BR
dc.rightsopenAccesspt_BR
dc.rights.urihttp://creativecommons.org/licenses/by-nc-nd/3.0/br/*
dc.subjectInteligência computacionalpt_BR
dc.subjectAprendizagempt_BR
dc.titleAugmenting product knowledge graphs with subjective informationpt_BR
dc.typedoctoralThesispt_BR
dc.contributor.authorLatteshttp://lattes.cnpq.br/0022427692093493pt_BR
dc.publisher.initialsUFPEpt_BR
dc.publisher.countryBrasilpt_BR
dc.degree.leveldoutoradopt_BR
dc.contributor.advisorLatteshttp://lattes.cnpq.br/7113249247656195pt_BR
dc.publisher.programPrograma de Pos Graduacao em Ciencia da Computacaopt_BR
dc.description.abstractxGrafos de Produto, do inglês Product Graphs (PGs), são grafos de conhecimento com dados sobre produtos de consumo. Essas estruturas têm o potencial de facilitar tarefas de Inteligência Artificial no comércio eletrônico. Os PGs armazenam dados factuais sobre produtos (ex: smartphones) e suas características (ex: marca, dimensões, e processador) coletados de diversas fontes. O enriquecimento dessas estruturas com informações dinâmicas e subjetivas, como opiniões de usuários, pode contribuir para a melhoria dessas tarefas. No entanto, esta é uma nova tarefa e os trabalhos existentes são baseados em abordagens supervisionadas. Neste trabalho de tese nós abordamos essa tarefa por meio de duas etapas complementares: (1) Nós desenvolvemos uma abordagem semi-supervisionada chamada Product Graph enriched with Opinions (PGOpi) para enriquecimento de PGs com opiniões extraídas de avaliações de clientes. Para isso, exploramos mineração de opinião, Supervisão Distante baseada em representação de palavras para mitigar a dependência na rotulagem manual de dados de treino, e utilizamos Aprendizagem Profunda para mapear as opiniões extraídas até os nós do PG; (2) Nós construímos um gerador de triplas opinativas chamado SYNthetiC OPinionAted TriplEs (SYNCOPATE) que pode substituir métodos tradicionais para extração pareada de aspectos e opiniões em avaliações de produtos. Para construí-lo realizamos In-Context Learning em um Modelo de Linguagem pré-treinado e adaptado. Nós efetuamos a avaliação experimental das duas etapas. O PGOpi foi avaliado em cinco categorias de produtos de duas plataformas de e-commerce. O PGOpi alcançou valores de micro F1-score superiores a modelos semi-supervisionados mais complexos, e apresentou performance comparável a um modelo de estado-da-arte totalmente supervisionado. O SYNCOPATE foi avaliado aumentando bases de treino de benchmarking com as triplas opinativas geradas sinteticamente. Quatro modelos de estado-da-arte para extração pareada de aspectos e opiniões foram treinados com esses dados sintéticos e avaliados. Os resultados obtidos mostraram que os modelos treinados com dados sintéticos apresentaram performance superior àqueles treinados em uma pequena porcentagem de dados rotulados e curados por humanos. Três avaliadores humanos atestaram a qualidade das triplas geradas sinteticamente.pt_BR
Aparece nas coleções:Teses de Doutorado - Ciência da Computação

Arquivos associados a este item:
Arquivo Descrição TamanhoFormato 
TESE Johny Moreira da Silva.pdf3,99 MBAdobe PDFThumbnail
Visualizar/Abrir


Este arquivo é protegido por direitos autorais



Este item está licenciada sob uma Licença Creative Commons Creative Commons