Тапсырыс беруші
Шешімдерді қабылдау мерзімі

29.12.25 (қоса алғанда)

Марапаттау нысаны

жеке қарастырылады

Өнім күйі

MVP

Тапсырма түрі

ҒЗТКЖ міндеттері

Сфера применения

Робототехника

Область задачи

Интеллектуалды басқару жүйелері

Тапсырманың (жобаның) мақсаты мен сипаттамасы

Жобаның мақсаты мәтіндік деректердің (ғылыми Мақалалар, Диссертациялар, кітаптар, басылымдар, интернет-ресурстар) ұзақ мерзімді сақтауды, жылдам өңдеуді және ауқымды қолжетімділікті қамтамасыз ететін таратылған индекстеу базасының технологиялық архитектурасын құру болып табылады. Міндет шеңберінде мыналар көзделеді: * ұйымдар мен өңірлер бойынша үлестіруді ескере отырып, деректерді сақтау моделін әзірлеу; * морфологиялық қалыпқа келтіру және мәтіндерді семантикалық өңдеу алгоритмдерін енгізу; * деректер көлемі Ұлттық мұрағат деңгейіне дейін өскен кезде де жоғары іздеу жылдамдығын қамтамасыз ету үшін индекстеуді оңтайландыру; * мәтіндік жақындықты талдау алгоритмдерін зерттеу, соның ішінде шингл, векторлық көріністер, және нейрондық модельдер; * көлденең масштабтау және ақауларға төзімділік механизмдерін жобалау.

Өнім түрі

БҚ/АЖ

Мәселенің сипаттамасы

Білім беру, ғылыми және мемлекеттік мекемелер жүктейтін ақпарат көлемінің өсуімен дәстүрлі монолитті мәліметтер базасы іздеу мен талдаудың тұрақты жылдамдығын қамтамасыз ету қабілетін жоғалтады. Шешуді қажет ететін мәселелер: * ұлттық деңгейде мәтіндерді сақтаудың бірыңғай архитектурасының болмауы; * деректер корпусы ұлғайған кезде сұраныстарды өңдеу жылдамдығының төмендеуі; * үлкен деректер жағдайында дәстүрлі индекстеу алгоритмдерінің тиімділігі төмен; * орталықтандырылған талдау мүмкіндігін сақтай отырып, әрбір ұйымның деректерін оқшаулауды қамтамасыз ету қажеттілігі; * семантикалық жақындықты талдау және қарыз алуды анықтау алгоритмдері үшін тұрақты және масштабталатын есептеу механизмінің қажеттілігі.

Күтілетін әсер

* ондаған миллион құжаттардың деректер көлемінде миллисекундта іздеу сұрауларын өңдеуге мүмкіндік беретін технологиялық архитектураны құру; * тереңірек индекстеу және семантикалық өңдеу алгоритмдері арқылы мәтіндік қарыз алуды талдаудың дәлдігін арттыру; * бөлінген сақтау моделі арқылы Орталық инфрақұрылымға жүктемені азайту; * ҚР барлық білім беру мекемелерін қамту және кейіннен ТМД елдеріне шығу үшін жүйені масштабтау мүмкіндігі; * сыртқы сервистерге тәуелді болмай, өзінің АИ-аналитика алгоритмдерін және жергілікті модельдерді енгізу үшін технологиялық негіз қалыптастыру.

Жауапты тұлғаның ТАӘ

Асылбеков Ұлан

Ескерту