Ақша сомасы: 0
Өтінімдер саны: 9
25.06.26 (қоса алғанда)
шарттық
MVP
Акт міндеттері
Робототехника
Нейротехнология және жасанды интеллект
БҚ/АЖ
Сөйлеуді тану және офлайн талдау технологияларын практикалық қолдануда аудио материалдардың ақпаратты дұрыс өңдеуге қойылатын талаптарға сәйкес келмеуі айтарлықтай кедергі болып табылады. Көбінесе екі спикер арасындағы диалог бір аудио арнада жазылады, бұл оларды кейінірек талдау және стенография үшін автоматты түрде бөлуді қиындатады. Орыс және қазақ тілдеріне арналған қолданыстағы ASR шешімдері, әсіресе аралас сөйлеу кезінде (code-switching) тұрақты диоризацияны қамтамасыз етпейді, бұл декодтаудың дәлдігі мен оқылуының төмендеуіне әкеледі.
Даму нәтижесі бағдарламалық жасақтама модулі болады: 1. Аудиожазбаны екі спикердің көшірмелеріне автоматты түрде бөлу (диоризация) 90-нан төмен емес дәлдікпен%; 2. Аралас мәлімдемелерді қоса алғанда, орыс және қазақ тілдерінде сөйлеуді дұрыс тану; 3. Спикерлердің уақыт белгілері мен идентификаторларын көрсете отырып, құрылымдық транскриптті қалыптастыру (Speaker 1, speaker 2); 4. API арқылы деректерді талдау және сақтау жүйелерімен үйлесімділік; 5. қажетті тану сапасын қамтамасыз ететін кез келген сыртқы немесе жергілікті STT қызметін пайдалану мүмкіндігі.
Данченко Максим
Тапсырманың (жобаның) мақсаты мен сипаттамасы
Орыс және қазақ тілдерінде репликалардың дәл бөлінуін және аудиожазбалардың дұрыс стенографиясын қамтамасыз ететін екі спикер үшін диоризацияны қолдайтын сөйлеуді автоматты тану модулін (ASR) құру. Тапсырманың сипаттамасы: Аудио файлды қабылдайтын және келесі функцияларды орындайтын бағдарламалық жасақтама механизмін жасаңыз: 1. сөйлеу учаскелерін анықтау және екі спикерге автоматты түрде бөлу; 2. орыс және қазақ тілдерінде сөйлеуді тану; 3. сөйлейтін және уақыт белгілері бар мәтіндік файлды қалыптастыру; 4. диоризацияның дәлдігін 90% - дан төмен емес және тану дәлдігін 85% - дан төмен емес қамтамасыз ету%; 5. дайын нәтижені кейінгі талдау мен интеграциялауға жарамды форматта ұсыну.