🚨 Informamos aos concluintes que após a validação do orientador no sistema, A BIBLIOTECA PRECISA DE 7 DIAS ÚTEIS para tratar e processar os dados. Por isso, NÃO DEIXE PARA ENVIAR O TCC (graduação ou pós-graduação) DE ÚLTIMA HORA. Dúvidas: repositorio@ufersa.edu.br🚨

Análise estatística de palavras e sentenças em textos de jornais potiguares

dc.contributor.advisorCarvalho, Cid Ivan da Costa
dc.contributor.advisormailcidivanc@ufersa.edu.br
dc.contributor.authorMenezes , Izodária Rutchely de Oliveira
dc.contributor.referee1Carvalho, Cid Ivan da Costa
dc.contributor.referee2Martins, Mário Gleisse das Chagas
dc.contributor.referee3Santos, Rosilda Sousa
dc.coverage.spatialCaraúbas
dc.date.accessioned2025-12-16T17:40:17Z
dc.date.available2025-12-16T17:40:17Z
dc.date.issued2022-11-18
dc.description.abstractA linguística de corpus é o estudo aprofundado de dados coletados, sendo eles dados textuais orais ou escritos que precisaram de uma coleta minuciosa, com a finalidade de contribuir para pesquisa de uma determinada língua ou variedade linguística. Geralmente, a coleta é realizada de forma direta por meios digitais, sendo eles: sites, revistas e blogs, ou de forma indireta por meio de programas de busca. A pesquisa objetiva analisar estatisticamente o número de palavras e sentenças de um corpus de textos em jornais potiguares. A importância deste trabalho se dá pela aplicação nos domínios da linguística, da linguística aplicada e da linguística computacional na notabilidade da programação visual e compilação de corpus, mostrando sua relevância para os estudos que visam desenvolver ferramentas computacionais que consistem em copilar e fazer a contagem das palavras em textos escritos. Para isso, fizemos uma pesquisa bibliográfica sobre os conceitos presentes na linguística de corpus, especialmente, do autor Sardinha (2004); depois, os dados na análise foram coletados em notícias de sites online do estado do Rio Grande do Norte. O corpus consiste em 30 textos resultando em 104.464 palavras distribuídas em 4 jornais online, sendo eles: Jornal de Fato, O Mossoroense, Potiguar Notícias e Tribuna do Norte.
dc.description.abstract2Corpus linguistics is the in-depth study of collected data, whether oral or written textual data that needed a thorough collection, with the purpose of contributing to the research of a particular language or linguistic variety. Generally, the collection is carried out directly by digital means, namely: websites, magazines and blogs, or indirectly through search engines. The research aims to statistically analyze the number of words and sentences of a corpus of texts in Potiguar newspapers. The importance of this work is given by the application in the domains of linguistics, applied linguistics and computational linguistics in the notability of visual programming and corpus compilation, showing its relevance for studies that aim to develop computational tools that consist of copying and counting the words in written texts. For this, we carried out a bibliographical research on the concepts present in corpus linguistics, especially by the author Sardinha (2004); then, the data in the analysis were collected from online news sites in the state of Rio Grande do Norte. The corpus consists of 30 texts resulting in 104,464 words distributed in 4 online newspapers, namely: Jornal de Fato, O Mossoroense, Potiguar Notícias and Tribuna do Norte.
dc.description.physical39 f.
dc.format.mimetypepdf
dc.identifier.bibliographicCitationMENEZES, Izodária Rutchely de Oliveira. Análise estatística de palavras e sentenças em textos de jornais potiguares. 2022. 39 f. Trabalho de Conclusão de Curso (Bacharelado em Ciência e Tecnologia) - Universidade Federal Rural do Semi-Árido, Caraúbas-RN, 2022.
dc.identifier.urihttps://repositorio.ufersa.edu.br/handle/prefix/14646
dc.language.isopt_BR
dc.publisher.countryBrasil
dc.publisher.initialsUFERSA
dc.publisher.institutionUversidade Federal Rural do Semi-Árido
dc.rightsinfo:eu-repo/semantics/openAccess
dc.rights.holderUFERSA
dc.rights.licenseAttribution-ShareAlike 3.0 Brazilen
dc.rights.urihttp://creativecommons.org/licenses/by-sa/3.0/br/
dc.subject.cnpqCIENCIAS EXATAS E DA TERRA::CIENCIA E TECNOLOGIA
dc.subject.keywordLinguística de Corpus
dc.subject.keywordColeta de Dados
dc.subject.keywordLíngua
dc.subject.keywordLinguística Computacional
dc.titleAnálise estatística de palavras e sentenças em textos de jornais potiguares
dc.typeinfo:eu-repo/semantics/bachelorThesis

Arquivos

Pacote original

Agora exibindo 1 - 1 de 1
Carregando...
Imagem de Miniatura
Nome:
IzodariaROM_MONO.pdf
Tamanho:
993,32 KB
Formato:
Adobe Portable Document Format

Licença do pacote

Agora exibindo 1 - 1 de 1
Carregando...
Imagem de Miniatura
Nome:
license.txt
Tamanho:
1,58 KB
Formato:
Item-specific license agreed upon to submission
Descrição: