Erika Rimkutė
Biographic Data
| ID | 6797005 |
|---|---|
| NAME | Erika Rimkutė |
| GIVEN NAMES | Erika |
| FAMILY NAME | Rimkutė |
| SIGNATURE | RIMKUTĖ E |
| AFFILIATIONS | Vytautas Magnus University |
| ORCID | 0000-0003-0858-8593 |
| VERIFIED | Yes |
| TOTAL WORKS | 18 |
| TOTAL CITATIONS | 1 |
| AUTHOR COUNT | 18 |
| EDITOR COUNT | 0 |
| FIRST PUBLICATION YEAR | 2004 |
| LATEST PUBLICATION YEAR | 2025 |
| H-INDEX | 1 |
Lietuvių kalbos būdvardžių analizė tekstynų lingvistikos metodu
This article aims to present a study during which the usage of 94 adjectives was analyzed to identify the adjectives of atypical usage. In this research, atypical adjectives are those that differ from other adjectives in terms of their grammatical and lexical-semantic features. The adjectives were selected from the Lexical Database of Lithuanian Language Usage and analyzed using the Pedagogic Corpus of Lithuanian. In total, 12 relative and 82 qua…
Naujų lietuvių kalbos anotuotų tekstynų rengimas
Iki šiol parengti lietuvių kalbos gramatiškai anotuotų tekstynų ištekliai (morfologiškai anotuotas tekstynas MATAS, sintaksiškai anotuotas tekstynas ALKSNIS) yra nepakankamo dydžio atsižvelgiant į augančius lietuvių kalbos kompiuterizavimo poreikius. Todėl ES NextGenerationEU projekte „Morfologiškai ir sintaksiškai anotuotų tekstynų modeliai apmokymui (auksiniai standartai)“ yra rengiami du nauji tekstynai pagal tarptautinį Universal Dependencies…
Why do Infinite Forms Matter
From the corpus data, we observe that in the real language usage, the particular verb does not appear in all theoretically possible finite and infinite verb forms in the morphologically rich Lithuanian but is used in those forms which are relevant for the verb patterning. On the one hand, by teaching vocabulary, is it important to represent lexis in these relevant forms – frequently used forms, and, on the other hand, in grammar teaching, there i…
Grammatical patterns in the corpus-driven “Lexical Database of Lithuanian”
This paper describes the grammatical patterning of two parts of speech – nouns and adjectives – included in the corpus-driven “Lexical Database of Lithuanian” as a foreign language. The lexical database is a lexicographic application of the Lithuanian Pedagogic Corpus (approx. 620.000 tokens) which was used to develop headword lists and to collect word usage information in the form of corpus patterns. In this project, we adopted a partially autom…
Automatizuotas arbitraliųjų kolokacijų atpažinimas
Straipsnyje analizuojamas vienas kolokacijų tipas – arbitraliosios kolokacijos. Jos laikomos nemotyvuotomis (tuo skiriasi nuo kito kolokacijų tipo – trivialiųjų, arba motyvuotųjų, kolokacijų, pvz.: graži diena, naujas tyrimas), joms būdingas ribotas leksinis junglumas: pagal panašią reikšmę teoriškai galima rinktis daugiau negu vieną žodį, bet linkstama vartoti būtent kurį nors vieną, pvz., platus akiratis, bet ne didelis akiratis, stipri sveikat…
Light Verb Constructions in Lithuanian
Light verb constructions (LVCs) are verb-noun constructions in which the noun carries the semantic meaning and the verb is semantically reduced, when compared with its main meaning, for example, atlikti analizę (‘to perform an analysis’). LVCs in Lithuanian have not been addressed much so far. The analysis of Lithuanian LVCs was carried out as a part of the PARSEME project on verbal identification of multiword expressions (MWE). This paper aims a…
Lietuvių kalbos pastoviųjų junginių gramatinis variantiškumas
Straipsnyje analizuojamas dviejų pastoviųjų junginių tipų – kolokacijų ir frazeologizmų – gramatinis variantiškumas. Pastovieji junginiai automatiškai nustatyti iš DELFI.lt tekstyno. Pastebėta, kad pastovieji junginiai tekstyne vartojami įvairiomis formomis, kurios negali būti laikomos reguliariomis kaitybinėmis. Gramatinis variantiškumas suskirstytas į 1) darybinį (kai viename junginyje pavartotas priešdėlis ar priesaga, o kitame, laikytiname va…
Towards the criteria for identification of idioms and collocations
The paper analyses two types of multi-word expressions: collocations and idioms. It providesdefinitions of these two types of lexical items and reviews their understanding in worksof Lithuanian and foreign scholars. A problem of identifying multi-word expressions arosewhen carrying out a research project Automatic Identification of Lithuanian Multi-word Expressions(PASTOVU). When the analysis of the corpus compiled from delfi.lt news portaltexts …
Morphemic Structure of Lithuanian Words
The Lithuanian language is a typical flectional language that has a very sophisticated system of grammatical forms and many means of derivation; it is also characterized by uncertain boundaries between morphemes. All this makes the morphemic analysis of the Lithuanian language very complex. The aim of this research is to define and describe morphemic structural models of inflective parts of speech (i.e. nouns, adjectives, numerals, pronouns, and …
Lithuanian-Latvian, Latvian-Lithuanian Parallel Corpus (Lila)
The paper presents a new linguistic resource, LILA, which is the Lithuanian-Latvian-Lithuanian parallel corpus aligned on paragraph and sentence level.The total size of the LILA corpus is 9 m words. So far it is a unique resource for this language pair. The corpus contains metadata with bibliographicalinformation (title, author, year of publishing, etc.). The corpus contains the structural annotation, which includes boundaries of aligned segments…
Lietuvių kalbos terminų automatinio nustatymo galimybės
Straipsnyje trumpai apžvelgta terminologinė situacija pasaulyje ir Lietuvoje, aprašoma, kaip pasikeitė terminologų bei terminografų darbas suklestėjus kompiuterinėms technologijoms, atsiradus tekstynams; kada kilo poreikis terminus analizuoti tekstynuose; kada atsirado pirmosios automatiškai terminus nustatančios programos. Šiame darbe pabrėžiama tekstynų svarba ir nauda analizuojant terminus, juos apibrėžiant, sudarant terminų žodynus. Taip pat …
Sudėtinės ir suaugtinės lietuvių kalbos morfologinės samplaikos
Iki šiol morfologinėmis samplaikomis (toliau MS) laikyti dvižodžiai ar ilgesni iš kaitomų ar (ir) ne-kaitomų kalbos dalių sudaryti sustabarėję junginiai, turintys bendrą reikšmę ir atliekantys vienos (dažniausiai nekaitomos) kalbos dalies funkciją. Kadangi lietuvių kalboje tą pačią funkciją atliekantys žodžiai (pvz., kažin kur – kažkur, vieną kartą – vienąkart) dėl rašybos taisyklių rašomi skirtingai, nuspręsta, kad reikėtų išplėsti MS sąvoką ir …
Lietuvių kalbos leksemų morfologinis anotavimas
Straipsnyje rašoma apie lietuvių kalbos morfologinio anotatoriaus veikimo principus, automatinės morfologinės analizės specifiką. Didžiausias dėmesys skiriamas vienam iš 2007–2008 m. Valstybinio mokslo ir studijų fondo remto projekto „Internetiniai ištekliai: anotuotas lietuvių kalbos tekstynas ir anotavimo priemonės (ALKA2)“ įgyvendintų darbų – lietuvių kalbos morfologinio anotatoriaus leksinės duomenų bazės pildymui. Išsamiai aprašoma į morfolo…
Gramatinėmorfologinisamplaikklasifikacija
Tiek lietuvių, tiek ir kitos kalbos yra fraziškos. Tai reiškia, kad kalbėdami renkamės ne atskirus žodžius, o tų žodžių junginius ar samplaikas. Šiame straipsnyje pateikta dažnai lietuvių kalboje vartojamų leksinių vienetų, atspindinčių kalbos fraziškumą, – morfologinių samplaikų – gramatinė klasifikacija. Morfologinės samplaikos – tai iš dviejų ar daugiau kaitomų ir nekaitomų kalbos dalių sudaryti stabiliai vartojami junginiai, sudarantys sintak…
Morfologinis dabartinės lietuvikalbos tekstyno anotavimas
Didėjant informacinių technologijų plėtrai, spartėjant kalbos kompiuterizavimo darbams, iškilo būtinybė kurti didelius anotuotus tekstynus tam, kad būtų galima pasinaudoti jų duomenimis pereinant į aukštesnius kalbos kompiuterizavimo lygmenis (pvz., automatinę sintaksinę ir semantinę analizę, mašininį vertimą). Straipsnyje pristatomi didelio lietuvių kalbos tekstyno automatinio morfologinio vienareikšminimo tyrimai ir anotavimo rezultatai. Remian…
Automatizuotas lietuvių kalbos morfologinio daugiareikšmiškumo ribojimas
Straipsnyje pristatomi galimi morfologinio daugiareikšmiškumo (toliau žymima MD) ribojimo būdai. Tai svarbu padaryti, kad būtų galima pradėti automatinę sintaksinę analizę, kurti ir lietuvių kalbai pritaikyti mašininio vertimo sistemas. Daugumai kalbų yra sukurti morfologiniai analizatoriai, kurie ne tik pateikia lemas ir morfologines pažymas, bet kartu ir pasirenka reikiamą formą iš kelių galimų. Lietuvių kalbos morfologinis analizatorius Lemuok…
Dažniausios lietuvikalbos morfologinio daugiareikšmiškumo ršys ir jautomatinis vienareikšminimas
Straipsnyje pristatomas mažai tyrinėtas lietuvių kalbos morfologinis daugiareikšmiškumas ir pirmieji automatinio vienareikšminimo bandymai. Rašoma apie automatiniu būdu sulemuotą ir morfologiškai anotuotą lietuvių kalbos tekstyną. Ištyrus anotuotą tekstyną, paaiškėjo, kad kalba yra labai daugiareikšmė – apie 50 proc. žodžių ar žodžių formų yra morfologiškai daugiareikšmės. Norint panaudoti morfologiškai anotuoto tekstyno duomenis tolesniems tyrim…
Artimkalbmašininis vertimas
Mašininis vertimas yra viena iš didžiausių kompiuterinės lingvistikos užduočių. Vertimo rezultatai tuo geresni, kuo siauresnė vertimo duomenų tema. Kitas svarbus kriterijus yra abiejų kalbų artimumas. Kaip paaiškėjo ankstesniuose projektuose, vertimui tarp artimų kalbų (pvz., tarp slavų) nereikia pilnos lingvistinės analizės – užtenka, pavyzdžiui, tik daiktavardžių ir panašių grupių analizės. Tai patvirtino Prahos Karlo universiteto Formaliosios …
Light Verb Constructions in Lithuanian
Light verb constructions (LVCs) are verb-noun constructions in which the noun carries the semantic meaning and the verb is semantically reduced, when compared with its main meaning, for example, atlikti analizę (‘to perform an analysis’). LVCs in Lithuanian have not been addressed much so far. The analysis of Lithuanian LVCs was carried out as a part of the PARSEME project on verbal identification of multiword expressions (MWE). This paper aims a…
Dažniausios lietuvikalbos morfologinio daugiareikšmiškumo ršys ir jautomatinis vienareikšminimas
Straipsnyje pristatomas mažai tyrinėtas lietuvių kalbos morfologinis daugiareikšmiškumas ir pirmieji automatinio vienareikšminimo bandymai. Rašoma apie automatiniu būdu sulemuotą ir morfologiškai anotuotą lietuvių kalbos tekstyną. Ištyrus anotuotą tekstyną, paaiškėjo, kad kalba yra labai daugiareikšmė – apie 50 proc. žodžių ar žodžių formų yra morfologiškai daugiareikšmės. Norint panaudoti morfologiškai anotuoto tekstyno duomenis tolesniems tyrim…
Artimkalbmašininis vertimas
Mašininis vertimas yra viena iš didžiausių kompiuterinės lingvistikos užduočių. Vertimo rezultatai tuo geresni, kuo siauresnė vertimo duomenų tema. Kitas svarbus kriterijus yra abiejų kalbų artimumas. Kaip paaiškėjo ankstesniuose projektuose, vertimui tarp artimų kalbų (pvz., tarp slavų) nereikia pilnos lingvistinės analizės – užtenka, pavyzdžiui, tik daiktavardžių ir panašių grupių analizės. Tai patvirtino Prahos Karlo universiteto Formaliosios …
Automatizuotas lietuvių kalbos morfologinio daugiareikšmiškumo ribojimas
Straipsnyje pristatomi galimi morfologinio daugiareikšmiškumo (toliau žymima MD) ribojimo būdai. Tai svarbu padaryti, kad būtų galima pradėti automatinę sintaksinę analizę, kurti ir lietuvių kalbai pritaikyti mašininio vertimo sistemas. Daugumai kalbų yra sukurti morfologiniai analizatoriai, kurie ne tik pateikia lemas ir morfologines pažymas, bet kartu ir pasirenka reikiamą formą iš kelių galimų. Lietuvių kalbos morfologinis analizatorius Lemuok…
Morfologinis dabartinės lietuvikalbos tekstyno anotavimas
Didėjant informacinių technologijų plėtrai, spartėjant kalbos kompiuterizavimo darbams, iškilo būtinybė kurti didelius anotuotus tekstynus tam, kad būtų galima pasinaudoti jų duomenimis pereinant į aukštesnius kalbos kompiuterizavimo lygmenis (pvz., automatinę sintaksinę ir semantinę analizę, mašininį vertimą). Straipsnyje pristatomi didelio lietuvių kalbos tekstyno automatinio morfologinio vienareikšminimo tyrimai ir anotavimo rezultatai. Remian…
Lietuvių kalbos leksemų morfologinis anotavimas
Straipsnyje rašoma apie lietuvių kalbos morfologinio anotatoriaus veikimo principus, automatinės morfologinės analizės specifiką. Didžiausias dėmesys skiriamas vienam iš 2007–2008 m. Valstybinio mokslo ir studijų fondo remto projekto „Internetiniai ištekliai: anotuotas lietuvių kalbos tekstynas ir anotavimo priemonės (ALKA2)“ įgyvendintų darbų – lietuvių kalbos morfologinio anotatoriaus leksinės duomenų bazės pildymui. Išsamiai aprašoma į morfolo…
Gramatinėmorfologinisamplaikklasifikacija
Tiek lietuvių, tiek ir kitos kalbos yra fraziškos. Tai reiškia, kad kalbėdami renkamės ne atskirus žodžius, o tų žodžių junginius ar samplaikas. Šiame straipsnyje pateikta dažnai lietuvių kalboje vartojamų leksinių vienetų, atspindinčių kalbos fraziškumą, – morfologinių samplaikų – gramatinė klasifikacija. Morfologinės samplaikos – tai iš dviejų ar daugiau kaitomų ir nekaitomų kalbos dalių sudaryti stabiliai vartojami junginiai, sudarantys sintak…
Lietuvių kalbos terminų automatinio nustatymo galimybės
Straipsnyje trumpai apžvelgta terminologinė situacija pasaulyje ir Lietuvoje, aprašoma, kaip pasikeitė terminologų bei terminografų darbas suklestėjus kompiuterinėms technologijoms, atsiradus tekstynams; kada kilo poreikis terminus analizuoti tekstynuose; kada atsirado pirmosios automatiškai terminus nustatančios programos. Šiame darbe pabrėžiama tekstynų svarba ir nauda analizuojant terminus, juos apibrėžiant, sudarant terminų žodynus. Taip pat …
Sudėtinės ir suaugtinės lietuvių kalbos morfologinės samplaikos
Iki šiol morfologinėmis samplaikomis (toliau MS) laikyti dvižodžiai ar ilgesni iš kaitomų ar (ir) ne-kaitomų kalbos dalių sudaryti sustabarėję junginiai, turintys bendrą reikšmę ir atliekantys vienos (dažniausiai nekaitomos) kalbos dalies funkciją. Kadangi lietuvių kalboje tą pačią funkciją atliekantys žodžiai (pvz., kažin kur – kažkur, vieną kartą – vienąkart) dėl rašybos taisyklių rašomi skirtingai, nuspręsta, kad reikėtų išplėsti MS sąvoką ir …
Lithuanian-Latvian, Latvian-Lithuanian Parallel Corpus (Lila)
The paper presents a new linguistic resource, LILA, which is the Lithuanian-Latvian-Lithuanian parallel corpus aligned on paragraph and sentence level.The total size of the LILA corpus is 9 m words. So far it is a unique resource for this language pair. The corpus contains metadata with bibliographicalinformation (title, author, year of publishing, etc.). The corpus contains the structural annotation, which includes boundaries of aligned segments…
Morphemic Structure of Lithuanian Words
The Lithuanian language is a typical flectional language that has a very sophisticated system of grammatical forms and many means of derivation; it is also characterized by uncertain boundaries between morphemes. All this makes the morphemic analysis of the Lithuanian language very complex. The aim of this research is to define and describe morphemic structural models of inflective parts of speech (i.e. nouns, adjectives, numerals, pronouns, and …
Towards the criteria for identification of idioms and collocations
The paper analyses two types of multi-word expressions: collocations and idioms. It providesdefinitions of these two types of lexical items and reviews their understanding in worksof Lithuanian and foreign scholars. A problem of identifying multi-word expressions arosewhen carrying out a research project Automatic Identification of Lithuanian Multi-word Expressions(PASTOVU). When the analysis of the corpus compiled from delfi.lt news portaltexts …
Lietuvių kalbos pastoviųjų junginių gramatinis variantiškumas
Straipsnyje analizuojamas dviejų pastoviųjų junginių tipų – kolokacijų ir frazeologizmų – gramatinis variantiškumas. Pastovieji junginiai automatiškai nustatyti iš DELFI.lt tekstyno. Pastebėta, kad pastovieji junginiai tekstyne vartojami įvairiomis formomis, kurios negali būti laikomos reguliariomis kaitybinėmis. Gramatinis variantiškumas suskirstytas į 1) darybinį (kai viename junginyje pavartotas priešdėlis ar priesaga, o kitame, laikytiname va…
Light Verb Constructions in Lithuanian
Light verb constructions (LVCs) are verb-noun constructions in which the noun carries the semantic meaning and the verb is semantically reduced, when compared with its main meaning, for example, atlikti analizę (‘to perform an analysis’). LVCs in Lithuanian have not been addressed much so far. The analysis of Lithuanian LVCs was carried out as a part of the PARSEME project on verbal identification of multiword expressions (MWE). This paper aims a…
Grammatical patterns in the corpus-driven “Lexical Database of Lithuanian”
This paper describes the grammatical patterning of two parts of speech – nouns and adjectives – included in the corpus-driven “Lexical Database of Lithuanian” as a foreign language. The lexical database is a lexicographic application of the Lithuanian Pedagogic Corpus (approx. 620.000 tokens) which was used to develop headword lists and to collect word usage information in the form of corpus patterns. In this project, we adopted a partially autom…
Automatizuotas arbitraliųjų kolokacijų atpažinimas
Straipsnyje analizuojamas vienas kolokacijų tipas – arbitraliosios kolokacijos. Jos laikomos nemotyvuotomis (tuo skiriasi nuo kito kolokacijų tipo – trivialiųjų, arba motyvuotųjų, kolokacijų, pvz.: graži diena, naujas tyrimas), joms būdingas ribotas leksinis junglumas: pagal panašią reikšmę teoriškai galima rinktis daugiau negu vieną žodį, bet linkstama vartoti būtent kurį nors vieną, pvz., platus akiratis, bet ne didelis akiratis, stipri sveikat…
Why do Infinite Forms Matter
From the corpus data, we observe that in the real language usage, the particular verb does not appear in all theoretically possible finite and infinite verb forms in the morphologically rich Lithuanian but is used in those forms which are relevant for the verb patterning. On the one hand, by teaching vocabulary, is it important to represent lexis in these relevant forms – frequently used forms, and, on the other hand, in grammar teaching, there i…
Lietuvių kalbos būdvardžių analizė tekstynų lingvistikos metodu
This article aims to present a study during which the usage of 94 adjectives was analyzed to identify the adjectives of atypical usage. In this research, atypical adjectives are those that differ from other adjectives in terms of their grammatical and lexical-semantic features. The adjectives were selected from the Lexical Database of Lithuanian Language Usage and analyzed using the Pedagogic Corpus of Lithuanian. In total, 12 relative and 82 qua…
Naujų lietuvių kalbos anotuotų tekstynų rengimas
Iki šiol parengti lietuvių kalbos gramatiškai anotuotų tekstynų ištekliai (morfologiškai anotuotas tekstynas MATAS, sintaksiškai anotuotas tekstynas ALKSNIS) yra nepakankamo dydžio atsižvelgiant į augančius lietuvių kalbos kompiuterizavimo poreikius. Todėl ES NextGenerationEU projekte „Morfologiškai ir sintaksiškai anotuotų tekstynų modeliai apmokymui (auksiniai standartai)“ yra rengiami du nauji tekstynai pagal tarptautinį Universal Dependencies…
Linguistics (11 works) · Lexicography and Language Studies (10 works) · linguistics and terminology studies (10 works) · Philosophy (9 works) · Linguistic research and analysis (7 works) · Lithuanian (7 works) · Philosophy (7 works) · Computer Science (6 works) · Natural language processing (6 works) · Natural Language Processing Techniques (6 works)