> Признаки для идентификации диктора

- ноября 04, 2020

Главное в анализе речевых данных – это выделить признаки, которые можно считать основными для идентификации лингвистического содержания. Все шумы и признаки которые отвечают за окраску можно отбросить. Принято использовать частотные или временные признаки отдельно или совместно. Считаю возможным использовать безразмерную величину как скважность, один из классификационных признаков импульсных систем, определяющий отношение периода следования (повторения) импульсов к длительности импульса.

Речевой сигнал на выходе компаратора будет прямоугольным, с импульсами с различной длительности и периодов. Смысловое содержание при прослушивании сохраняется. Чем выше частота тем ближе звук к оригиналу. В теории ни бум-бум проверял на практике.

Речь диктора можно прокрутить быстрее или тише значит изменятся и частотные и временные характеристики. Не изменится лишь скважность. Остается найти алгоритмы нахождения участков со скважностью присущих лишь этому диктору.

Как нейронная сеть SincNet выделяет значимые частоты в звуке через Back Propagation

Поиск по этому блогу

ABCD

> Признаки для идентификации диктора

Как нейронная сеть SincNet выделяет значимые частоты в звуке через Back Propagation

Комментарии

Отправить комментарий

Популярные сообщения из этого блога

Распознавание речи без библиотек

АРИФМЕТИКА МУЗЫКИ

Психология без мозга