Abstract
Ushbu maqolada tabiiy tilni qayta ishlash (NLP) va amaliy lingvistikaning muhim yo‘nalishlaridan biri bo‘lgan ingliz-o‘zbek parallel korpuslarida uslubiy va semantik annotatsiya qilish metodologiyasi hamda uning nazariy asoslari adabiyotlar tahlili asosida yoritiladi. Kross-lingvistik parallel korpuslar ko‘p ma’noli so‘zlarni bir qiymatli ajratish (Word Sense Disambiguation – WSD), leksik birliklarning kontekstual va uslubiy muqobilligini aniqlash hamda bilingval leksikonlarni yaratishdagi o‘rni tahlil qilingan. Matnlarni jumlalar va so‘zlar darajasida moslashtirish, semantik ma’no proyeksiyasi hamda uslublararo differensiallash bosqichlari tizimlashtirilgan.
References
Navigli R. Word sense disambiguation: A survey // ACM Computing Surveys (CSUR). – New York: ACM, 2009. – Vol. 41. – No. 2. – P. 1–69.
2. Ide N., Véronis J. Multilingual Corpus Resources and Tools for Word Sense Disambiguation // Word Sense Disambiguation: Algorithms and Applications. – Dordrecht: Springer, 2013. – P. 35–64.
3. Diab M., Resnik P. An Unsupervised Method for Word Sense Tagging using Parallel Corpora // Proceedings of the 40th Annual Meeting of the Association for Computational Linguistics (ACL). – Philadelphia: ACL, 2002. – P. 255–262.
4. Biber D. Register, Genre, and Style // Cambridge Textbooks in Linguistics. – Cambridge: Cambridge University Press, 2004. – P. 45–88.
5. Och F. J., Ney H. A Systematic Comparison of Various Statistical Alignment Models // Computational Linguistics. – Cambridge: MIT Press, 2003. – Vol. 29. – No. 1. – P. 19–51.