Четверг, 05 Ноября 2020 г. 12:44
+ в цитатник
babai-rais: Главное в анализе речевых данных – это выделить признаки, которые можно считать основными для идентификации лингвистического содержания. Все шумы и признаки которые отвечают за окраску можно отбросить. Принято использовать частотные или временные признаки отдельно или совместно. Считаю возможным использовать безразмерную величину как скважность, один из классификационных признаков импульсных систем, определяющий отношение периода следования (повторения) импульсов к длительности импульса.
Речевой сигнал на выходе компаратора получится прямоугольным, с импульсами с различной длительности и периодов. Смысловое содержание при прослушивании сохраняется. Чем выше частота тем ближе звук к оригиналу. В теории ни бум-бум НО проверял на практике.
Речь диктора можно прокрутить быстрее или тише значит изменятся и частотные и временные характеристики. Не изменится лишь скважность. Остается найти алгоритмы нахождения участков со скважностью присущих различным комбинациям звуков.
Есть, кажись, теорема что любое сообщение можно восстановить если знать каким способом оно закодировано. Читал в теории связи, поищу. Решение вопроса нужно искать у математиков, если получится задачу сформулировать кратко. Общие рассуждения не помогут.
https://forum.sources.ru/index.php?showtopic=416524&view=findpost&p=3841764
Метки:
Речевые Технологии
-
Запись понравилась
-
0
Процитировали
-
0
Сохранили
-