91×ÔÅÄ

КТМУда тил технологиялары жана корпус лингвистикасы боюнча эл аралык семинар башталды


  • 2026-09-22

Кыргыз-Түрк «Манас» университетини кабыл алуусунда (КТМУ) табигый тилди иштетүү технологиялары жана корпус лингвистикасынын тил жана котормо изилдөөлөрүндө колдонулушу жөнүндө эл аралык семинар өттү. КТМУнун гуманитардык факультетинин синхрондук котормо бөлүмү менен Германиядагы Саарланд университетинин биргелешкен кызматташтыгында уюштурулган семинар 2026-жылдын 21–24-сентябрь аралыгында өтүүдө.

Erasmus+ KA171 университеттер аралык макулдашуусунун алкагында уюштурулган «Табигый тилди иштетүү технологиялары жана корпус лингвистикасы» аталышындагы семинар 21-сентябрда гуманитардык факультеттин Касым Тыныстанов атындагы жыйын залында башталды. Төрт күндүк программада катышуучуларга табигый тилди иштетүү, корпус түзүү жана санариптик изилдөө куралдарын колдонуу боюнча теориялык жана практикалык окутуулар өткөрүлүүдө.

Тил изилдөөлөрүндөгү санариптик ыкмалар каралат

Компьютердик илимдер, жасалма интеллект жана лингвистиканын ортосундагы илимдер аралык заманбап ыкмаларга көңүл бурган семинарда метамаалыматтар жана лингвистикалык аннотация, синтаксистик анализ, Universal Dependencies (UD), туруктуу туюнтмалар аркылуу корпустан издөө, жасалма интеллекттин жардамы менен корпусту анализдөө, дискурс анализи, сапаттык маалыматтарды анализдөө жана параллель корпустар каралууда.

Саарланд университетинен келген др. Мари-Полин Крилке жана др. Андреа Вурм жүргүзгөн окутууларда катышуучулар изилдөө суроолоруна ылайыктуу корпус куралдарын тандоо, издөө, синтаксистик талдоо жүргүзүү жана түрдүү санариптик платформаларды колдонуу боюнча практикалык иштерди аткарышат.

Программада студент котормо корпустары аркылуу котормодогу каталарды изилдөө, мазмундук жана грамматикалык каталарга баа берүү, котормо тарыхы жана кош тилдүүлүк изилдөөлөрү сыяктуу темаларга да орун берилген. Француз жана немис тилдериндеги тарыхый документтерден параллель корпустарды түзүү, документтерди сканерлеп, жасалма интеллекттин жардамы менен текстке айландыруу, тексттерди тууралоо жана кол менен белгилөө программанын практикалык бөлүмүндө орун алган.

Кыргыз тилинин санариптик булактары өнүктүрүлүүдө

Семинардын ачылышында КТМУ гуманитардык факультетинин синхрондук котормо бөлүмүнүн башчысы, проф. докт. Аида Касиева «Кыргыз тилинин корпус лингвистикасы» деген темада баяндама жасады. Баяндамада кыргыз тилине багытталган электрондук корпустарды өнүктүрүү жана тилдик маалыматтарды илимий изилдөөлөрдө колдонуу маселелерине басым жасалды.

Катышуучуларга өздөрүнүн изилдөө суроолоруна ылайыктуу корпустарды тандоо, түзүү жана колдонуу ыкмалары үйрөтүлгөн программада кыргызча-англисче, кыргызча-түркчө, орусча-түркчө жана түркчө-англисче сыяктуу түрдүү тил түгөйлөрү аркылуу параллель корпус иштерин кантип жүргүзүү керектиги изилденүүдө.

КТМУ гуманитардык факультетинин деканынын орун басары, PhD. Лейла Бабатүрк семинардын алкагындагы баалоосунда кыргыз тили үчүн сапаттуу жана текшерилген санариптик булактарды өнүктүрүүнүн маанилүүлүгүнө көңүл бурду. Бабатүрк кыргыз тилинин морфологиялык жактан белгиленген биринчи ири электрондук корпусу 2019-жылы көркөм тексттер менен түзүлө баштаганын, ага гезит архивдери, макал-лакаптар жана Чыңгыз Айтматовдун 10 томдук жыйнагы кошулушу менен корпустун көлөмү болжол менен 4 миллион сөзгө жеткенин билдирди.

Жасалма интеллект системалары тилдик маалыматтар менен азыктанарын белгилеген Бабатүрк, бул системалардын кыргыз тилинде кетирген каталарын азайтуу үчүн ишенимдүү санариптик тил булактарына муктаждык бар экенин айтты.

Проф. докт. Аида Касиева да семинар кыргыз тилин заманбап технологиялар аркылуу изилдөөгө, сактоого жана өнүктүрүүгө салым кошууну максат кыларын билдирди. Кыргыз тили санариптик булактары чектелүү тилдердин катарына кирерин эскерткен Касиева, тилдин санариптик чөйрөдөгү ордун чыңдай турган иштердин маанилүүлүгүн баса белгиледи.

 

Жасалма интеллекттен параллель корпустарга чейинки практикалык программа

 

Семинардын экинчи күнүндө метамаалыматтар, лингвистикалык аннотация, туруктуу туюнтмалар аркылуу корпусту сурап-билүү жана жасалма интеллекттин жардамы менен корпусту анализдөө маселелерине басым жасалууда. Үчүнчү күнү Universal Dependencies, синтаксистик анализ жана Sketch Engine программасы аркылуу дискурс анализи боюнча иштер жүргүзүлөт. Соңку күнү MAXQDA жана TEI/XML куралдарын колдонуу менен сапаттык маалыматтарды анализдөө, параллель корпустар жана тиешелүү санариптик колдонмолор каралат.

 

Кыргыз тилин санарипдик чөйрөдө өнүктүрүүгө көңүл бурулду

 

Семинардын 23-сентябрь Кыргыз Республикасынын Мамлекеттик тил күнү камтылган жумалыкта уюштурулушу кыргыз тилин санарип чөйрөдө сактоого жана өнүктүрүүгө багытталган иштерди да күн тартибине чыгарды. Семинардын бул жагы Кыргыз Республикасынын Президенти тарабынан жарыяланган «Улуттук рух — глобалдык туу чоку» доктринасынын мамлекеттик тилди сактоо, өнүктүрүү жана заманбап илим менен технологиянын мүмкүнчүлүктөрү аркылуу чыңдоо мамилесине толугу менен шайкеш келет.

 

Кыргыз тилине 1989-жылдын 23-сентябрында мамлекеттик тил макамы берилгенин эске салган Касиева, Мамлекеттик тил күнүнүн эне тилди сактоо, өнүктүрүү жана коомдук турмуштун түрдүү тармактарында колдонуусун кеңейтүү жагынан маанилүү экенин айтты.

 

Төрт күнгө созула турган эл аралык семинар 24-сентябрда жыйынкталат. Программанын соңунда катышуучуларга сертификаттар тапшырылат.

 

    Социалдык медиада бөлүшүү