Autor(es):
Sousa, Aline Rocha de
Data: 2017
Origem: Oasisbr
Assunto(s): Processamento de linguagem natural (Computação); Linguagem natural; Português do Brasil; Sociedade da informação; Competências em informação; Processamento de linguagem natural (Computação); Processamento de linguagem natural (Computação); Linguagem natural; Linguagem natural; Português do Brasil; Português do Brasil; Sociedade da informação; Sociedade da informação; Competências em informação; Competências em informação
Descrição
Trabalho de Conclusão de Curso (graduação)—Universidade de Brasília, Instituto de Letras, Departamento de Línguas Estrangeiras e Tradução, Línguas Estrangeiras Aplicadas ao Multilinguismo e à Sociedade da Informação, 2015.
Submitted by Caroline Botelho Teixeira (carolineteixeira@bce.unb.br) on 2017-12-15T11:51:37Z No. of bitstreams: 3 license_text: 0 bytes, checksum: d41d8cd98f00b204e9800998ecf8427e (MD5) license_rdf: 0 bytes, checksum: d41d8cd98f00b204e9800998ecf8427e (MD5) 2015_AlineRochaDeSousa_tcc.pdf: 1348017 bytes, checksum: ca53d92ddf37f419aa87715836141f8b (MD5)
Rejected by Luanna Maia (luanna@bce.unb.br), reason: devolvendo on 2017-12-15T12:40:18Z (GMT)
Submitted by Caroline Botelho Teixeira (carolineteixeira@bce.unb.br) on 2017-12-15T12:41:09Z No. of bitstreams: 3 license_text: 0 bytes, checksum: d41d8cd98f00b204e9800998ecf8427e (MD5) license_rdf: 0 bytes, checksum: d41d8cd98f00b204e9800998ecf8427e (MD5) 2015_AlineRochaDeSousa_tcc.pdf: 1348017 bytes, checksum: ca53d92ddf37f419aa87715836141f8b (MD5)
Approved for entry into archive by Ruthlea Nascimento (ruthlea.nascimento@gmail.com) on 2017-12-20T16:54:24Z (GMT) No. of bitstreams: 3 license_text: 0 bytes, checksum: d41d8cd98f00b204e9800998ecf8427e (MD5) license_rdf: 0 bytes, checksum: d41d8cd98f00b204e9800998ecf8427e (MD5) 2015_AlineRochaDeSousa_tcc.pdf: 1348017 bytes, checksum: ca53d92ddf37f419aa87715836141f8b (MD5)
Made available in DSpace on 2017-12-20T16:54:24Z (GMT). No. of bitstreams: 3 license_text: 0 bytes, checksum: d41d8cd98f00b204e9800998ecf8427e (MD5) license_rdf: 0 bytes, checksum: d41d8cd98f00b204e9800998ecf8427e (MD5) 2015_AlineRochaDeSousa_tcc.pdf: 1348017 bytes, checksum: ca53d92ddf37f419aa87715836141f8b (MD5)
O Processamento Automático de Línguas Naturais é um domínio de pesquisa promissor quanto à organização de dados digitais na Sociedade da Informação, ao buscar recuperá-los pela língua de registro. Por outro lado, as especificidades de cada língua exigem tratamentos computacionais diferentes e, se não compreendidas em profundidade, podem constituir entraves à produção tecnológica. Esta pesquisa tem por objetivo investigar as particularidades do processamento automático do português brasileiro, comparado ao inglês americano e ao português europeu, a partir de um estudo de caso sobre a localização do sistema de perguntas e respostas Watson da IBM. Inicia-se com um levantamento teórico sobre o estado-da-arte do Processamento de Línguas Naturais, aborda as especificidades da arquitetura DeepQA no tratamento linguístico do sistema e detalha as particularidades do português do Brasil que devem ser observadas na localização do Watson. Da investigação, possíveis adaptações ao sistema são apresentadas, e a importância da inclusão do português brasileiro e, de modo geral, do Brasil na Sociedade da Informação é posta em reflexão.
Automatic Natural Language Processing is a promising research domain to the organization of digital data in the Information Society, as it seeks to recover them by the language in which they are registered. Nevertheless, the specificities of each language require different computational treatments and, if not understood in depth, may hinder the technological production. This research aims to investigate the particularities of the automatic processing of Brazilian Portuguese, compared to American English and European Portuguese, from a case study on the localization of IBM Watson question-answering system. It begins with a theoretical survey on the state of the art of Natural Language Processing, addresses the specificities of the DeepQA architecture in processing language for the system and details the particularities of Brazilian Portuguese that have to be regarded in Watson's localization. From the research, possible adaptations to the system are presented, and the importance of including Brazilian Portuguese and, in general, Brazil in the Information Society is brought into consideration.