• JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
 
  Bookmark and Share
 
 
Tese de Doutorado
DOI
https://doi.org/10.11606/T.55.2020.tde-16022021-151616
Documento
Autor
Nome completo
Edilson Anselmo Corrêa Júnior
E-mail
Unidade da USP
Área do Conhecimento
Data de Defesa
Imprenta
São Carlos, 2020
Orientador
Banca examinadora
Amancio, Diego Raphael (Presidente)
Comin, César Henrique
Liang, Zhao
Travieso, Gonzalo
Título em inglês
Using complex networks and Deep Learning to model and learn context
Palavras-chave em inglês
Ambiguity
Complex networks
Context
Deep learning
Resumo em inglês
The structure of language is strongly influenced by the context, whether it is the social setting, of discourse (spoken and written) or the context of words itself. This fact allowed the creation of several techniques of Natural Language Processing (NLP) that take advantage of this information to tackle a myriad of tasks, including machine translation, summarization and classification of texts. However, in most of these applications, the context has been approached only as a source of information and not as an element to be explored and modeled. In this thesis, we explore the context on a deeper level, bringing new representations and methodologies. Throughout the thesis, we considered context as an important element that must be modeled in order to better perform NLP tasks. We demonstrated how complex networks can be used both to represent and learn context information while performing word sense disambiguation. In addition, we proposed a context modeling approach that combines word embeddings and a network representation, this approach allowed the induction of senses in an unsupervised way using community detection methods. Using this representation we further explored its application in text classification, we expanded the approach to allow the extraction of text features based on the semantic flow, which were later used in a supervised classifier trained to discriminate texts by genre and publication date. The studies carried out in this thesis demonstrate that context modeling is important given the interdependence between language and context, and that it can bring benefits for different NLP tasks. The framework proposed, both for modeling and textual feature extraction can be further used to explore other aspects and mechanisms of language.
Título em português
Modelagem e aprendizado de contexto usando redes complexas e Deep Learning
Palavras-chave em português
Ambiguidade
Contexto
Deep learning
Redes complexas
Resumo em português
A estrutura da língua é fortemente influenciada pelo contexto, seja ele social, do discurso (falado e escrito) ou o próprio contexto de palavras. Este preceito propiciou a criação de várias técnicas de Processamento de Língua Natural (PLN) que tiram vantagem dessa informação para realizar uma miríade de tarefas, incluindo tradução automática, sumarização e classificação de textos. Entretanto, em grande parte dessas aplicações o contexto tem sido abordado apenas como uma informação de entrada e não como um elemento a ser explorado e modelado. Nesta tese, exploramos o contexto em um nível mais profundo, trazendo novas representações e metodologias. Ao longo da tese, consideramos o contexto como um elemento importante que deve ser modelado para melhor desempenhar as tarefas da PLN. Demonstramos como redes complexas podem ser usadas para representar e aprender informações de contexto durante a desambiguação do sentido das palavras. Além disso, propusemos uma abordagem de modelagem de contexto que combina word embeddings e uma representação de rede, esta abordagem permitiu a indução de sentidos de uma forma não supervisionada usando métodos de detecção de comunidade. Usando essa representação exploramos sua aplicação na classificação de textos, expandimos a abordagem para permitir a extração de características de texto com base no fluxo semântico, que foram posteriormente usadas em um classificador supervisionado treinado para discriminar textos por gênero e data de publicação. Os estudos realizados nesta tese demonstram que a modelagem de contexto é importante dada a interdependência entre linguagem e contexto, e que pode trazer benefícios para diferentes tarefas de PLN. O framework proposto, tanto para modelagem quanto para extração de características textuais, pode ser posteriormente utilizado para explorar outros aspectos e mecanismos da linguagem.
 
AVISO - A consulta a este documento fica condicionada na aceitação das seguintes condições de uso:
Este trabalho é somente para uso privado de atividades de pesquisa e ensino. Não é autorizada sua reprodução para quaisquer fins lucrativos. Esta reserva de direitos abrange a todos os dados do documento bem como seu conteúdo. Na utilização ou citação de partes do documento é obrigatório mencionar nome da pessoa autora do trabalho.
Data de Publicação
2021-02-16
 
AVISO: Saiba o que são os trabalhos decorrentes clicando aqui.
Todos os direitos da tese/dissertação são de seus autores
CeTI-SC/STI
Biblioteca Digital de Teses e Dissertações da USP. Copyright © 2001-2024. Todos os direitos reservados.