Skip to main content

ETHNOS_APP

Home • Search • Journals • List 0

Desenvolvimento de ferramentas computacionais para o processamento de dados dialetais e lexicográficos

Bibliographic Data

ID4897726
AuthorsJorge Luiz Nunes Dos Santos Junior (0000-0002-1111-4148, Universidade Federal de Mato Grosso do Sul, corresponding author)
Year2023
Volume16
Publication date2023-01-01
Peer ReviewedYes
Open AccessYes
TypeARTICLE
VenueTexto Livre Linguagem e Tecnologia (JOURNAL)
Journal identifiersISSN: 1983-3652 • E-ISSN: 1983-3652
PublisherFapUNIFESP (SciELO) (PUBLISHER)
DOI10.1590/1983-3652.2023.42302
OpenAlexW4382996874
SCIELO_PIDS1983-36522023000100214
LanguagePT
References cited2

Este trabalho situa-se na intersecção da Linguística de Corpus (O'KEEFFE; MCCARTHY, 2010); Linguística Computacional (KEDIA; RASU, 2020; SRINIVASA-DESIKAN, 2018; MANNING, 2008; MANNING; SCHUTZE, 1999; CHOMSKY, 1965); Dialetologia (CARDOSO, 2010; RADTKE; THUN, 1996; CHAMBERS; TRUDGILL, 1994) e Lexicografia (TARP, 2008, 2011, 2015; FUERTES-OLIVEIRA; BERGENHOLTZ, 2015; LEROYER, 2011). Tem-se como objetivo apresentar o desenvolvimento de ferramentas computacionais capazes de processar dados de natureza dialetal e lexicográfica a partir de uma metodologia que dispensa a contratação de serviços de programação, convidando o pesquisador a estudar os recursos informáticos necessários para realizar a manipulação automática de informações em um banco de dados. Para tanto, o corpus utilizado foi o do Projeto Atlas Linguístico do Brasil (COMITÊ NACIONAL DO PROJETO ALIB, 2001), relativo aos municípios do interior, da rede de pontos do ALiB, na região Norte do país. A construção desses pequenos programas foi motivada, principalmente, por duas razões: i) fornecer tratamento lexicográfico e eletrônico aos dados dialetais do ALiB; ii) desenvolver as próprias ferramentas computacionais para atender aos objetivos da pesquisa de Doutorado em andamento à qual este artigo se vincula. Desse modo, um banco de dados em Extensible Markup Language (XML) foi construído para armazenar as informações dialetais em formato lexicográfico e, a partir da execução de linhas de código, foi possível recuperar dados específicos do corpus de maneira eletrônica, além de filtrar os resultados a partir das variantes 'sexo', 'idade' e 'localidade', presentes nos dados do corpus do ALiB

Humanities · Physics · Computer Science · Lexicography and Language Studies · Linguistics and Language Studies · Natural Language Processing Techniques · Philosophy

  • Introduction to Information Retrieval

    Open Access•Christopher D Manning, Prabhakar Raghavan et al.•Introduction to Information…•2008

  • The Routledge handbook of corpus linguistics

    Anne O’Keeffe, Marina Mccarthy et al.•The Routledge handbook of corpus…•2010

Citation velocityhistorical
Highly citedNo

Tools

Open DOIOpen Access
Ethnos_APP • Open Source Project • MIT License • Frontend v2.0.0 • Privacy and Cookies • API Documentation: api.ethnos.app/docs • API Source Code: GitHub • DOI: 10.5281/zenodo.17049435 • Frontend Source Code: GitHub • DOI: 10.5281/zenodo.17050053 • cruz.rio.br • Expectantes Misericordiae