Desenvolvimento de ferramentas computacionais para o processamento de dados dialetais e lexicográficos
Bibliographic Data
| ID | 4897726 |
|---|---|
| Authors | Jorge Luiz Nunes Dos Santos Junior (0000-0002-1111-4148, Universidade Federal de Mato Grosso do Sul, corresponding author) |
| Year | 2023 |
| Volume | 16 |
| Publication date | 2023-01-01 |
| Peer Reviewed | Yes |
| Open Access | Yes |
| Type | ARTICLE |
| Venue | Texto Livre Linguagem e Tecnologia (JOURNAL) |
| Journal identifiers | ISSN: 1983-3652 • E-ISSN: 1983-3652 |
| Publisher | FapUNIFESP (SciELO) (PUBLISHER) |
| DOI | 10.1590/1983-3652.2023.42302 |
| OpenAlex | W4382996874 |
| SCIELO_PID | S1983-36522023000100214 |
| Language | PT |
| References cited | 2 |
Este trabalho situa-se na intersecção da Linguística de Corpus (O'KEEFFE; MCCARTHY, 2010); Linguística Computacional (KEDIA; RASU, 2020; SRINIVASA-DESIKAN, 2018; MANNING, 2008; MANNING; SCHUTZE, 1999; CHOMSKY, 1965); Dialetologia (CARDOSO, 2010; RADTKE; THUN, 1996; CHAMBERS; TRUDGILL, 1994) e Lexicografia (TARP, 2008, 2011, 2015; FUERTES-OLIVEIRA; BERGENHOLTZ, 2015; LEROYER, 2011). Tem-se como objetivo apresentar o desenvolvimento de ferramentas computacionais capazes de processar dados de natureza dialetal e lexicográfica a partir de uma metodologia que dispensa a contratação de serviços de programação, convidando o pesquisador a estudar os recursos informáticos necessários para realizar a manipulação automática de informações em um banco de dados. Para tanto, o corpus utilizado foi o do Projeto Atlas Linguístico do Brasil (COMITÊ NACIONAL DO PROJETO ALIB, 2001), relativo aos municípios do interior, da rede de pontos do ALiB, na região Norte do país. A construção desses pequenos programas foi motivada, principalmente, por duas razões: i) fornecer tratamento lexicográfico e eletrônico aos dados dialetais do ALiB; ii) desenvolver as próprias ferramentas computacionais para atender aos objetivos da pesquisa de Doutorado em andamento à qual este artigo se vincula. Desse modo, um banco de dados em Extensible Markup Language (XML) foi construído para armazenar as informações dialetais em formato lexicográfico e, a partir da execução de linhas de código, foi possível recuperar dados específicos do corpus de maneira eletrônica, além de filtrar os resultados a partir das variantes 'sexo', 'idade' e 'localidade', presentes nos dados do corpus do ALiB
Humanities · Physics · Computer Science · Lexicography and Language Studies · Linguistics and Language Studies · Natural Language Processing Techniques · Philosophy
| Citation velocity | historical |
|---|---|
| Highly cited | No |