Проєкт файлу XML на основі рекомендацій TEI для бази даних цифрового словника українських запозичень із німецької мови
收藏资源简介:
Abstrtact The digital content provided here is a demo version of a database of German lexical borrowings in the Ukrainian language. The database is designed in TEI XML format in accordance with the current international TEI Lex-0 standards. It consolidates historical and etymological information on Ukrainian lexical Germanisms, as well as on borrowings from other languages (Latin, French, etc.) mediated by the German language. The structure of the dictionary entries is based on the model entries from the 7-volume ‘Etymological Dictionary of the Ukrainian Language’ by the O. O. Potebnia Institute of Linguistics of the National Academy of Sciences of Ukraine (chief editor O. S. Melnychuk) (ESUM). The material in this dictionary also forms the basis of our database, though it has undergone significant revision and refinement: in particular, the print version is being digitally marked-up using the TEI Lex-0 standards (around 400 entries have been processed out of the 3,000 Ukrainian keywords available in the database; including the separate marking of each lexical variant and each derivative; the same is done for non-Slavic equivalents); meanings of Ukrainian keywords, checked against modern explanatory dictionaries, are added; grammatical information is added to each Ukrainian keyword and its German equivalents; German equivalents are checked using German lexicographic corpora; the content of older Ukrainian dictionaries (by P. Biletsky-Nosenko, Y. Zhelekhivsky, B. Hrinchenko, D. Yavornytsky, and others) is cross-referenced with references to them in the ESUM (which often allows for a significantly deeper understanding of the semantic processes involved in the transition of a German word into the Ukrainian language, and in some cases even enables additions or corrections to be made); where possible, the narrow territorial origin of words that are generally marked as dialectal in the ESUM is specifically indicated. At the same time, material that did not make it into the ESUM is also included. A distinctive feature of the dictionary’s content is the inclusion of an author-compiled corpus of Ukrainian words modelled on German examples (the corpus of these words is as yet small—around one and a half to two hundred). Alongside standard lexicographical notes, the database reserves a section for classifying a particular word within a specific semantic domain. The structural features of the database and its lexicographical content give reason to hope for the scientific novelty and relevance of this research. The source code for the Python-Flask application designed to work with the described XML-based database project is published separately. Анотація Пропонований цифровий контент є демонстраційною версією структури бази даних словника німецьких лексичних запозичень в українській мові. База спроєктована у форматі TEI XML відповідно до сучасних міжнародних стандартів TEI Lex-0. У ній консолідована історико-етимологічна інформація про українські лексичні германізми, а також про опосередковані німецькою мовою запозичення з інших мов (латинської, французької тощо). За основу структури словникової статті прийняті зразки статей 7-томного «Етимологічного словника української мови» Інституту мовознавства ім. О. О. Потебні НАНУ (гол. ред. О. С. Мельничук) (ЕСУМ). Матеріали цього словника також покладені в основу нашої бази даних, однак із суттєвою переробкою і доопрацюванням: зокрема, здійснюється цифрова розмітка паперового варіанту з використання стандартів TEI Lex-0 (опрацьовано близько 400 статей із 3000 наявних у базі українських ключових слів; у тому числі окремо позначається кожний лексичний варіант та кожний дериват; те ж саме провадиться щодо інослов’янських відповідників); додаються звірені за сучасними тлумачними словниками значення українських ключових слів; додається граматична інформація до кожного ключового українського слова та до його німецьких відповідників; німецькі відповідники перевіряються із використанням лексикографічних корпусів німецької мови; проводиться звірка змісту давніших словників української мови (П. Білецького-Носенка, Є. Желехівського, Б. Грінченка, Д. Яворницького та ін.) з посиланнями на них в ЕСУМ (що часто дозволяє суттєво глибше розуміти семантичні процеси при переході німецького слова в українську мову, почасти навіть ввести доповнення або виправлення); по можливості спеціально маркується вузька територіальна приналежність слів, які в ЕСУМ мають загальну позначку як діалектних. Разом із тим залучається матеріал, який не потрапив до ЕСУМ. Особливістю самого змісту словника є включення в нього авторської бази українських слів, калькованих за німецькими зразками (корпус цих слів поки що незначний — сотні півтори-дві). Поруч із звичайними лексикографічними помітками в базі зарезервований блок для віднесення того чи іншого слова до певного семантичного домену. Представлені особливості структури бази даних та її лексикографічного наповнення дозволяють сподіватися на наукову новизну і актуальність цього наукового доробку. Цифровий код застосунку на Python-Flask для роботи з описаним проєктом бази даних на основі файлу XML, публікується окремо.



