Utilização do modelo skip-gram para representação distribuída de palavras no projeto Media Cloud Brasil
Lopes, Evandro Dalbem
O documento é disponibilizado pela fonte de origem, que mantém a versão integral e as condições de uso.
Resumo
Existe um problema de representação em processamento de linguagem natural, pois uma vez que o modelo tradicional de bag-of-words representa os documentos e as palavras em uma unica matriz, esta tende a ser completamente esparsa. Para lidar com este problema, surgiram alguns métodos que são capazes de representar as palavras utilizando uma representação distribuída, em um espaço de dimensão menor e mais compacto, inclusive tendo a propriedade de relacionar palavras de forma semântica. Este trabalho tem como objetivo utilizar um conjunto de documentos obtido através do projeto Media Cloud Brasil para aplicar o modelo skip-gram em busca de explorar relações e encontrar padrões que facilitem na compreensão do conteúdo.
Ficha do documento
- Tipo
- Dissertação
- Ano
- 2015
- Instituição
- Fundação Getulio Vargas
- Fonte
- Repositório da FGV
- Idioma
- Português
- Acesso
- Não informado
- Identificador
- oai:repositorio.fgv.br:10438/16685
Conteúdos relacionados
- DissertaçãoAplicação do Word2vec e do Gradiente descendente dstocástico em tradução automáticaFundação Getulio Vargas · 2016
- OutroInferring and explaining potential citations to binding precedents in Brazilian Supreme Court DecisionsFundação Getulio Vargas · 2021
- OutroTransformersFundação Getulio Vargas · 2021
- DissertaçãoA machine learning approach to dengue forecastingFundação Getulio Vargas · 2018