Наукова електронна бібліотека
періодичних видань НАН України

Технология разметки звуковых файлов с использованием неточного текстового сопровождения

Репозиторій DSpace/Manakin

Показати простий запис статті

dc.contributor.author Пилипенко, В.В.
dc.date.accessioned 2013-06-19T18:21:39Z
dc.date.available 2013-06-19T18:21:39Z
dc.date.issued 2012
dc.identifier.citation Технология разметки звуковых файлов с использованием неточного текстового сопровождения / В.В. Пилипенко // Кибернетика и вычисл. техника. — 2012. — Вип. 169. — С. 67-77. — Бібліогр.: 7 назв. — рос. uk_UA
dc.identifier.issn 0452-9910
dc.identifier.uri http://dspace.nbuv.gov.ua/handle/123456789/45873
dc.description.abstract Описана технология разметки звуковых файлов с использованием неточного текстового сопровождения. Предварительно формируется система распознавания на основе речевых записей, размеченных экспертами. Новые речевые записи распознаются для выяснения временны́х границ слов. Процедура сравнения ответа распознавания и неточного описания выявляет фрагменты звука, для которых есть точное соответствие. На основе автоматически полученной разметки строится новая, более точная система автоматического многодикторного распознавания спонтанной украинской речи с объемом словаря в 125 тысяч словоформ. Проведенные эксперименты показали пословную точность распознавания в 80 %. uk_UA
dc.description.abstract Описано технологію розмітки звукових файлів з використанням неточного текстового супроводження. Заздалегідь формується система розпізнавання мовлення на базі мовленнєвих записів, розмічених експертами. Нові мовленнєві записи розпізнаються для з’ясування меж слів у часовому просторі. Процедура порівняння відповіді розпізнавання і неточного текстового опису виявляє фрагменти звуку, для яких є точний збіг текстового опису зі звуковим сигналом. На базі автоматично отриманої розмітки будується нова більш точна система автоматичного багатодикторного розпізнавання спонтанної української мови з обсягом словника в 125 тисяч словоформ. Наведені результати експериментів, які показали точність 80 % послівного розпізнавання. uk_UA
dc.description.abstract This paper describes the speech labeling technology using an inexact text description. Preliminary there was built the speech recognition system based on the manually labeled corpus. This system is used to recognize new voice records and to determine the words temporal boundaries. A comparison of the recognition response and inexact text description identifies the audio chunks, where there is an exact match. The new more accurate large vocabulary continuous speech recognition system for Ukrainian is build by using the automatically labeled corpus. This approach can be useful for automatic labeling of large amount of partially annotated audio signals, so that the significantly reducing the cost of developing speech recognition systems is achieved. Experimental results show the effectiveness of the approach and reduce errors in speech recognition by 24.8 % so that the accuracy of 80 % by word recognition is achieved for broadcasts. uk_UA
dc.language.iso ru uk_UA
dc.publisher Міжнародний науково-навчальний центр інформаційних технологій і систем НАН України та МОН України uk_UA
dc.relation.ispartof Кибернетика и вычислительная техника
dc.subject Информационные технологии и системы uk_UA
dc.title Технология разметки звуковых файлов с использованием неточного текстового сопровождения uk_UA
dc.title.alternative Технологія розмітки звукових файлів з використанням неточного текстового супроводження uk_UA
dc.title.alternative Speech labeling technology using inexact text description uk_UA
dc.type Article uk_UA
dc.status published earlier uk_UA
dc.identifier.udc 004.934


Файли у цій статті

Ця стаття з'являється у наступних колекціях

Показати простий запис статті

Пошук


Розширений пошук

Перегляд

Мій обліковий запис