In translated language research, Lithuanian is still an underrepresented language, although there are several parallel and comparable corpora which could be used as data sources in corpus-based translation studies. This paper aims to compare the structural features of abstract noun collocations in translated and non-translated (original) Lithuanian across fiction and popular science genres. For this small-scale pilot study, eleven abstract nouns were selected, and their collocations were extracted semi-automatically from a 4-million-word monolingual comparable corpus ORVELIT. ORVELIT consists of four sub-corpora: original and translated fiction, as well as original and translated popular science texts. Collocations were classified by their parts of speech, and the analysis focused on both quantitative differences and the lexical diversity of the collocates. When considering the structural properties of collocations in our analysis, collocations that consist of two nouns emerged as being more diverse in original popular science texts. The results also show that there are more unique collocations with adjectives in original fiction, i.e. the lexical diversity of collocates is wider than in translation. In addition, some syntactic differences between translated and original popular science collocations were observed: nouns in translations are more often modified with an infinitive, while in original texts, the attribute function is more often expressed with a noun in the genitive case. Conclusions and recommendations suggest that more data needs to be included to examine the observed tendencies. Adding the data from the general corpus of Lithuanian for testing how typical and frequent observed collocations are could be a necessary methodological step to provide more solid research outcomes.
Anthony, Laurence. 2023. Common Statistics Used in Corpus Linguistics. Prieiga internetu: https://www.laurenceanthony.net/resources/statistics/common_statistics_used_in_corpus_linguistics.pdf. Žiūrėta: 2025 m. gegužės 29 d.
Baker, Mona. 1993. Corpus Linguistics and Translation Studies – Implications and Applications. Text and Technology: In honour of John Sinclair. Mona Baker, Gill Francis & Elena Tognini-Bonelli, eds. Amsterdam: John Benjamins. 233–250. https://doi.org/10.1075/z.64.15bak?locatt=mode:legacy
Baker, Mona. 1996. Corpus-based translation studies: The challenges that lie ahead. Terminology, LSP and Translation: Studies in language engineering in honour of Juan C. Sager. Harold Somers, ed. Amsterdam: John Benjamins. 175–186. https://doi.org/10.1075/btl.18.17bak?locatt=mode:legacy
Baker, Mona. 2011. In other words: a coursebook on translation. London: Routledge.
Baroni, Marco, Silvia Bernardini. 2006. A New Approach to the Study of Translationese: Machine-learning the Difference between Original and Translated Text. Literary and Linguistic Computing 21 (3), 259–274. https://doi.org/10.1093/llc/fqi039
Bernardini, Silvia. 2007. Collocations in translated language: combining parallel, comparable and reference corpora. Proceedings of the Corpus Linguistics Conference (CL2007). Birmingham: University of Birmingham. 1–16. https://hdl.handle.net/11585/54057
Bielinskienė, Agnė, Jolanta Kovalevskaitė, Erika Rimkutė, Laura Vilkaitė. 2017. Kolokacijų ir frazeologizmų atpažinimo kriterijai. Kalbų studijos 31, 83–101. http://dx.doi.org/10.5755/j01.sal.0.31.18710
Bielinskienė, Agnė, Jolanta Kovalevskaitė, Erika Rimkutė, Laura Vilkaitė-Lozdienė. 2019a. Lietuvių kalbos pastoviųjų junginių gramatinis variantiškumas. Kalbų studijos 34, 91–110. http://dx.doi.org/10.5755/j01.sal.0.34.21214
Bielinskienė, Agnė, Loïc Boizou, Ieva Bumbulienė, Jolanta Kovalevskaitė, Tomas Krilavičius, Justina Mandravickaitė, Erika Rimkutė, Laura Vilkaitė-Lozdienė. 2019b. Lietuvių kalbos kolokacijų žodynas. Kaunas: Vytauto Didžiojo universitetas. https://doi.org/10.7220/9786094673733
Bielinskienė, Agnė, Loïc Boizou, Ieva Bumbulienė, Jolanta Kovalevskaitė, Tomas Krilavičius, Justina Mandravickaitė, Erika Rimkutė, Jurgita Vaičenonienė, Laura Vilkaitė-Lozdienė, sud. 2022. Lietuvių kalbos pastoviųjų žodžių junginių duomenų bazė. Kaunas: Vytauto Didžiojo universiteto leidykla. https://doi.org/10.7220/20.500.12259/240653
Boizou, Loïc, Ieva Bumbulienė, Jolanta Kovalevskaitė, Erika Rimkutė, Jurgita Vaičenonienė, sud. 2022: Lietuvių kalbos arbiraliųjų kolokacijų žodynas. Kaunas: Vytauto Didžiojo universitetas. https://doi.org/10.7220/9786094675232
Boizou, Loïc, Jolanta Kovalevskaitė, Erika Rimkutė. 2015. Lietuvių kalbos dvižodžių junginių morfologinių ir sintaksinių ypatybių sąsajos. Darbai ir dienos 64, 115–131. https://doi.org/10.7220/2335-8769.64.6
Brezina, Vaclav. 2018. Statistics in Corpus Linguistics. A Practical Guide. Cambridge: Cambridge University Press.
Chesterman, Andrew. 2004. Hypotheses about translation universals. Claims, Changes and Challenges in Translation Studies. Gyde Hansen, Kirsten Malmkjær & Daniel Gile, eds. Amsterdam: John Benjamins. 1–13.
Dayrell, Carmen. 2008. Investigating the preference of translators for recurrent lexical patterns: A corpus-based study. Trans-kom 1 (1), 36–57.
Drūlienė, Viltė. 2014. Lietuvių kalbos apibendrinamieji daiktavardžiai: leksinė reikšmė ir pragmatinės funkcijos. Humanitarinių mokslų daktaro disertacija. Kaunas: Vytauto Didžiojo universiteto leidykla.
Feng, Haoda, Ineke Crezee, Lynn Grant. 2018. Form and meaning in collocations: a corpus-driven study on translation universals in Chinese-to-English business translation. Perspectives. Studies in Translation Theory and Practice 26 (5), 677–690. https://doi.org/10.1080/0907676X.2018.1424222
Frankenberg-Garcia, Ana, Diana Santos. 2003. Introducing COMPARA, the Portuguese-English parallel translation corpus. Corpora in Translation Education. Federico Zanettin, Silvia Bernardini & Dominic Stewart, eds. Manchester: St. Jerome Publishing, 71–87. https://doi.org/10.4324/9781315760162
Hareide, Lidun. 2019. Comparable parallel corpora. A critical review of current practices in corpus-based translation studies. Parallel Corpora for Contrastive and Translation Studies. New Resources and Applications. Irene Doval & María Teresa Sánchez Nieto, eds. Amsterdam: John Benjamins. 19–38. https://doi.org/10.1075/scl.90.02har?locatt=mode:legacy
Jancaitė-Skarbalė, Laima. 2026. Lietuvių kalbos dalyvių būdvardėjimas: kategorizacijos kriterijai tekstynų vartosenos pagrindu. Humanitarinių mokslų daktaro disertacija. Kaunas: Vytauto Didžiojo universiteto leidykla.
Jia, Juan, Muhammad Afzaal, Swaleha Bano Naqvi. 2022. Myth or reality? Some directions on translation universals in recent corpus based case studies. Frontiers in Psychology 13, 1–11. https://doi.org/10.3389/fpsyg.2022.902400
Karaliūtė, Asta. 2010. Statistiniai kolokacijų nustatymo metodai ir vertimo atitikmenys lygiagrečiajame grožinės literatūros tekstyne. Magistro darbas. Kaunas: Vytauto Didžiojo universitetas.
Kovalevskaitė, Jolanta. 2026. Kolokacijų panaudojimas iliustruojant žodžių vartoseną aiškinamuosiuose žodynuose. Bendrinė kalba 99 (priimta spausdinti).
Kovalevskaitė, Jolanta, Erika Rimkutė, Jurgita Vaičenonienė. 2022a. Lietuvių kalbos kolokacijos: vartojimas, mokymas(is) ir vertimas: mokomoji priemonė. Kaunas: Vytauto Didžiojo universitetas. https://doi.org/10.7220/9786094675249
Kovalevskaitė, Jolanta, Loïc Boizou, Ieva Bumbulienė, Erika Rimkutė, Jurgita Vaičenonienė. 2022b. Approaches and Resources for Lithuanian Collocation Research. Baltic Journal of Modern Computing 10 (3), 481–489. https://doi.org/10.22364/bjmc.2022.10.3.20
Kovalevskaitė, Jolanta, Erika Rimkutė, Jurgita Vaičenonienė. 2021. Arbitraliųjų lietuvių kalbos kolokacijų nustatymas. Bendrinė kalba 94, 1–37. https://doi.org/10.35321/bkalba.2021.94.06
Marcinkevičienė, Rūta. 2010. Lietuvių kalbos kolokacijos. Kaunas: Vytauto Didžiojo universitetas.
Mauranen, Anna. 2004. Corpora, universals and interference. Translation Universals. Do they Exist? Anna Mauranen & Pekka Kujamki, eds. Amsterdam: John Benjamins. 65–82.
Neumann, Stella, Silvia Hansen-Schirra. 2005. The CroCo Project: Cross-linguistic corpora for the investigation of explicitation in translations. Presentation, Corpus Linguistics Conference, Birmingham, 14–17 July 2005. Available at: https://fedora.clarin-d.uni-saarland.de/croco-gecco/croco/presentation_neumann_hansenschirra.pdf. Žiūrėta: 2025 m. gegužės 29 d.
Pastor, Gloria Corpas. 2017. Collocational constructions in translated Spanish: what corpora reveal. Computational and corpus-based phraseology. Ruslan Mitkov, ed. Cham: Springer. 29–40. https://doi.org/10.1007/978-3-319-69805-2_3
Rimkutė, Erika, Agnė Bielinskienė, Jolanta Kovalevskaitė. 2012. Lietuvių kalbos daiktavardinių frazių žodynas. Kaunas: Vytauto Didžiojo universitetas. https://sitti.vdu.lt/fraziu-zodynas/.
Rimkutė, Erika, Jolanta Kovalevskaitė, Vidas Daudaravičius. 2006. Daugiakalbių tekstynų naudojimas ir taikymas. Darbai ir Dienos 45, 41–62. https://doi.org/10.7220/2335-8769.45.3
Skadiņa, Inguna, Andrejs Vasiļjevs, Raivis Skadiņš, Robert Gaizauskas, Dan Tufiş, Tatiana Gornostay. 2010. Analysis and Evaluation of Comparable Corpora for Under Resourced Areas of Machine Translation. Proceedings of the 3rd Workshop on Building and Using Comparable Corpora (LREC 2010). Malta, 6–14.
Stulpinaitė, Miglė, Jolita Horbačauskienė, Ramunė Kasperavičienė. 2016. Issues in Translation of Linguistic Collocations. Kalbų studijos 29, 31–41. https://doi.org/10.5755/j01.sal.0.29.15056
Szudarski, Pavel. 2018. Corpus linguistics for vocabulary: a guide for research. London: Routledge. https://doi.org/10.4324/9781315107769
Toury, Gideon. 1980. In Search of a Theory of Translation. Tel Aviv: Porter Institute for Poetics and Semiotics, Tel Aviv University.
Trawiński, Beata, Susan Schlotthauer, Piotr Bański. 2020. CoMParS: Eine Sammlung von multilingualen Parallelsequenzen des Deutschen und anderer europäischer Sprachen. Deutsch in Europa: Sprachpolitisch, grammatisch, methodisch. Henning Lobin, Andreas Witt & Angelika Wöllstein, eds. Berlin, Boston: De Gruyter. 301–310. https://doi.org/10.1515/9783110731514-016
Vaičenonienė, Jurgita. 2014. How relevant is the distinction between the original and translated texts in general corpora? Proceedings of Human Language Technologies – The Baltic Perspective. Andrius Utka, Gintarė Grigonytė, Jurgita Kapočiūtė-Dzikienė & Jurgita Vaičenonienė, eds. Amsterdam: IOS Press. 248–256. https://doi.org/10.3233/978-1-61499-442-8-248
Vaičenonienė, Jurgita, Jolanta Kovalevskaitė. 2019. Leksinės ir morfologinės vertimų kalbos ypatybės. Darnioji daugiakalbystė 14 (1), 208–235. https://doi.org/10.2478/sm-2019-0010
Vaičenonienė, Jurgita, Jolanta Kovalevskaitė, Teresė Ringailienė. 2017. Tekstynais paremti vertimų kalbos tyrimai ir šaltiniai. Kalbų studijos 30, 42–56. https://doi.org/10.5755/j01.sal.0.30.17693
Vaičenonienė, Jurgita. 2023. Besimokančiųjų vertimo studentų tekstynas MUST-LT: kolokacijų vertimo atvejo analizė. Kalbų studijos 42, 105–118. https://doi.org/10.5755/j01.sal.1.42.33269
Vaičenonienė, Jurgita. 2024. Dviskaitos vertimo ypatumai: lyginamasis tekstynais grįstas tyrimas. Darnioji daugiakalbystė 24 (1), 257–278. https://doi.org/10.2478/sm-2024-0010
Volansky, Vered, Noam Ordan, Shuly Wintner. 2015. On the features of translationese. Digital Scholarship in the Humanities 30 (1), 98–118. https://doi.org/10.1093/llc/fqt031
Volungevičienė, Skaistė. 2013. Kolokacijų vertimo problemos: gretinamoji vokiečių–lietuvių kalbų studija. Humanitarinių mokslų daktaro disertacija. Vilnius: Vilniaus universiteto leidykla.
Xiao, Richard. 2010. How different is translated Chinese from native Chinese? A corpus-based study of translation universals. International Journal of Corpus Linguistics 15 (1), 5–35. https://doi.org/10.1075/ijcl.15.1.01xia

Šis darbas apsaugotas Creative Commons priskyrimo 4.0 viešąja licencija.