
Даже при использовании слухового аппарата глухим людям может быть довольно сложно разобрать голоса конкретных людей в шумной обстановке. Новая система динамиков может помочь, автоматически распознавая и усиливая голос избранного человека.
В многолюдных местах, таких как общественные собрания, обычные слуховые аппараты просто усиливают весь звук в комнате. В результате повышенный голос любого человека заглушается повышенными голосами всех остальных. Это явление известно как «эффект коктейльной вечеринки».
Некоторые технологии, которые можно внедрить в существующие слуховые аппараты, решают эту проблему, изолируя и усиливая голос человека, находящегося непосредственно перед пользователем слухового аппарата. Эти системы действительны работают, но только до тех пор, пока говорящий и глухой человек находятся лицом к лицу.
Разработанная учеными японской корпорации NTT, системаpeakBeam использует другой подход.
Он использует две нейронные сети, одну из которых изначально необходимо обучить на 10-секундной записи голоса говорящего. Эта сеть анализирует запись, известную как «адаптационное высказывание», определяя точные качества голоса, которые делают ее уникальной.
В последующей обстановке, похожей на коктейльную вечеринку, другой нейронная сеть использует эти данные голосовой подписи, чтобы отличить голос говорящего от голосов других людей, находящихся поблизости. Затем он усиливает только этот голос и продолжает делать это, даже если говорящий и пользователь отворачиваются друг от друга.
Конечно, один недостаток динамика заключается в том, что он улучшает требуют первоначального адаптационного высказывания. Это означает, что это не будет работать в сценариях, в которых говорящий еще не предоставил образец голоса.
Также иногда возникает путаница, когда два человека с одинаковыми голосами говорят одновременно. Ученые работают над решением этой проблемы, совершенствуя алгоритм распознавания голоса и определяя направление, откуда исходит каждый голос.




