Logo
Estudo

Sobrenomes e ancestralidade no Brasil

Monasterio, Leonardo Monteiro

O documento é disponibilizado pela fonte de origem, que mantém a versão integral e as condições de uso.

Resumo

Este trabalho apresenta um método de classificação da ancestralidade dos sobrenomes dos brasileiros nas seguintes classes: ibérica, italiana, japonesa, alemã e leste europeia. A partir de fontes históricas diversas, montou-se uma base de dados da ancestralidade dos sobrenomes. Essas informações formam a base para a aplicação de algoritmos de classificação de fuzzy matching e de machine learning nos mais de 46 milhões de trabalhadores da Relação Anual de Informações Sociais (Rais) Migra de 2013. A imensa maioria (96,4%) dos sobrenomes únicos da Rais foi identificada com o processo de fuzzy matching e os demais com o método proposto por Cavnar e Trenkle (1994). A comparação dos resultados do procedimento com dados sobre estrangeiros no Censo Demográfico de 1920 e a distribuição geográfica dos sobrenomes não ibéricos reforçam a acurácia do procedimento.

Ficha do documento

Tipo
Estudo
Ano
2016
Instituição
Instituto de Pesquisa Econômica Aplicada (Ipea)
Idioma
Português
Acesso
Acesso aberto
Identificador
oai:repositorio.ipea.gov.br:11058/7019
Licença
Licença Comum
Abrangência
Brasil
Temas
Dados

Conteúdos relacionados

Voltar à Biblioteca
Logo