Новости

Технология слуховых аппаратов SpeedBeam усиливает голоса только определенных людей

Технология слуховых аппаратов SpeakerBeam усиливает голоса только определенных людей

Даже при использовании слухового аппарата глухим людям может быть довольно сложно разобрать голоса конкретных людей в шумной обстановке. Новая система динамиков может помочь, автоматически распознавая и усиливая голос избранного человека.

В многолюдных местах, таких как общественные собрания, обычные слуховые аппараты просто усиливают весь звук в комнате. В результате повышенный голос любого человека заглушается повышенными голосами всех остальных. Это явление известно как «эффект коктейльной вечеринки».

Некоторые технологии, которые можно внедрить в существующие слуховые аппараты, решают эту проблему, изолируя и усиливая голос человека, находящегося непосредственно перед пользователем слухового аппарата. Эти системы действительны работают, но только до тех пор, пока говорящий и глухой человек находятся лицом к лицу.

Разработанная учеными японской корпорации NTT, системаpeakBeam использует другой подход.

Он использует две нейронные сети, одну из которых изначально необходимо обучить на 10-секундной записи голоса говорящего. Эта сеть анализирует запись, известную как «адаптационное высказывание», определяя точные качества голоса, которые делают ее уникальной.

В последующей обстановке, похожей на коктейльную вечеринку, другой нейронная сеть использует эти данные голосовой подписи, чтобы отличить голос говорящего от голосов других людей, находящихся поблизости. Затем он усиливает только этот голос и продолжает делать это, даже если говорящий и пользователь отворачиваются друг от друга.

Конечно, один недостаток динамика заключается в том, что он улучшает требуют первоначального адаптационного высказывания. Это означает, что это не будет работать в сценариях, в которых говорящий еще не предоставил образец голоса.

Также иногда возникает путаница, когда два человека с одинаковыми голосами говорят одновременно. Ученые работают над решением этой проблемы, совершенствуя алгоритм распознавания голоса и определяя направление, откуда исходит каждый голос.

Источник

Похожие статьи

Кнопка «Наверх»