Наушники с ИИ позволяют слушать одного человека в толпе, взглянув на него лишь раз
В Вашингтонском университете (UW) разработали систему искусственного интеллекта, которая позволяет пользователю в наушниках посмотреть на говорящего человека в течение трёх-пяти секунд, а затем слушать только его голос, даже на ходу среди толпы и без дополнительной настройки.
Доступные на рынке наушники с шумоподавлением очень хорошо зарекомендовали себя. Но возможность игнорировать определённые звуки и вычленять другие по-прежнему бросает вызов исследователям.
Разработанную в UW систему создатели называют TSH, от Target Speech Hearing, то есть целевое прослушивание речи. TSH игнорирует все посторонние звуки вокруг и воспроизводит только голос целевого говорящего в режиме реального времени.
Старший соавтор изобретения Шьям Голлакота отметил, что многие представляют ИИ в первую очередь как чат-бота, который отвечает на вопросы. Но при воплощении проекта с умными наушниками речь шла о таком ИИ, который изменяет слышимое пользователю в наушниках, как он того пожелает. С помощью новых устройств можно чётко слышать определенного говорящего среди других болтающих людей.
Чтобы воспользоваться TSH, человек в наушниках с микрофонами нажимает кнопку, направив голову в сторону говорящего. Затем звуковые волны от голоса собеседника должны достигать микрофонов на обеих сторонах гарнитуры одновременно. Погрешность при этом составляет 16 градусов. Наушники посылают сигнал на встроенный компьютер, где программное обеспечение с машинным обучением запоминает желаемые вокальные отличия (паттерны) говорящего. Система улавливает голос говорящего и продолжает воспроизводить его для слушателя, даже когда человек в наушниках и тот, кого слушают, перемещаются. Способность TSH фокусироваться на конкретном голосе в процессе улучшается, получая от говорящего всё больше и больше обучающих данных.
Изобретатели протестировали свою систему на 21 человеке, которые оценили чистоту голоса того, чью речь отслеживала TSH. И сказали, что она была примерно вдвое лучше по сравнению с «сырым», обычным звучанием.
Концепт основан на предыдущем исследовании тех же учёных, которое они назвали «семантический слух». Тот научный проект позволял людям в наушниках выбирать определённые типы предпочтительных для прослушивания звуков из окружающего шума, например, или пение птиц, или голоса людей.
Теперь система TSH может фиксироваться только на одном говорящем, при условии, что другой громкий голос не доносится с той же стороны. Видимо, если бы парочка в обнимку трещала наперебой, TSH бы запуталась. Но когда пользователь недоволен качеством звука, он может перезапустить выбор цели с помощью динамика, чтобы улучшить чёткость.
Теперь те же изобретатели займутся улучшением ИИ для как для наушников, так и для слуховых аппаратов.
Доступные на рынке наушники с шумоподавлением очень хорошо зарекомендовали себя. Но возможность игнорировать определённые звуки и вычленять другие по-прежнему бросает вызов исследователям.
Разработанную в UW систему создатели называют TSH, от Target Speech Hearing, то есть целевое прослушивание речи. TSH игнорирует все посторонние звуки вокруг и воспроизводит только голос целевого говорящего в режиме реального времени.
Старший соавтор изобретения Шьям Голлакота отметил, что многие представляют ИИ в первую очередь как чат-бота, который отвечает на вопросы. Но при воплощении проекта с умными наушниками речь шла о таком ИИ, который изменяет слышимое пользователю в наушниках, как он того пожелает. С помощью новых устройств можно чётко слышать определенного говорящего среди других болтающих людей.
Чтобы воспользоваться TSH, человек в наушниках с микрофонами нажимает кнопку, направив голову в сторону говорящего. Затем звуковые волны от голоса собеседника должны достигать микрофонов на обеих сторонах гарнитуры одновременно. Погрешность при этом составляет 16 градусов. Наушники посылают сигнал на встроенный компьютер, где программное обеспечение с машинным обучением запоминает желаемые вокальные отличия (паттерны) говорящего. Система улавливает голос говорящего и продолжает воспроизводить его для слушателя, даже когда человек в наушниках и тот, кого слушают, перемещаются. Способность TSH фокусироваться на конкретном голосе в процессе улучшается, получая от говорящего всё больше и больше обучающих данных.
Изобретатели протестировали свою систему на 21 человеке, которые оценили чистоту голоса того, чью речь отслеживала TSH. И сказали, что она была примерно вдвое лучше по сравнению с «сырым», обычным звучанием.
Концепт основан на предыдущем исследовании тех же учёных, которое они назвали «семантический слух». Тот научный проект позволял людям в наушниках выбирать определённые типы предпочтительных для прослушивания звуков из окружающего шума, например, или пение птиц, или голоса людей.
Теперь система TSH может фиксироваться только на одном говорящем, при условии, что другой громкий голос не доносится с той же стороны. Видимо, если бы парочка в обнимку трещала наперебой, TSH бы запуталась. Но когда пользователь недоволен качеством звука, он может перезапустить выбор цели с помощью динамика, чтобы улучшить чёткость.
Теперь те же изобретатели займутся улучшением ИИ для как для наушников, так и для слуховых аппаратов.
- Дмитрий Ладыгин
- youtu.be/ArGKgodEUSo
Наши новостные каналы
Подписывайтесь и будьте в курсе свежих новостей и важнейших событиях дня.
Рекомендуем для вас
Кто убивает итальянских волков: зоологи были потрясены кадрами с автоматической камеры
Трагический эпизод показал, что некоторые зоологические теории придется кардинально пересмотреть. У серых хищников есть неожиданные враги...
Очередной миф Николая Карамзина полностью развеян российскими археологами
Оказалось, что Иван Грозный не убивал супругу своего младшего брата. Напротив, с княгиней Ульянией Углицкой случалась куда более таинственная и запутанная...
Самая запрещенная русская сказка: почему «Курочку Рябу» не любили ни цари, ни руководители СССР?
Чтобы эту историю можно было рассказывать советским детям, ее сюжет пришлось изменить самым радикальным образом. Но, может быть, это и к лучшему...
Американский «Чернобыль-80»: эта катастрофа едва не изменила всю историю США
Эксперты говорят: лишь счастливая случайность не позволила взорваться заряду в 600 (!) раз мощнее хиросимской бомбы...
300-летний секрет «золотых» скрипок Страдивари наконец-то разгадан?
И почему ученые в поисках тайны забрели в отдаленную долину в самом сердце Итальянских Альп?...
80 лет без Звезды Героя: почему офицер, поставивший Знамя Победы, не получил заслуженную награду при жизни?
Только указ Президента России смог исправить одну из самых вопиющих несправедливостей в советской истории...
«Кровавая» история водопада Блад-Фоллс: почему ученые сравнивают это место с Марсом?
Эта антарктическая аномалия больше века не давала покоя исследователям, но в 2018 году завеса тайны все же приоткрылась...
Гениальное ДНК-«мошенничество»: ученые раскрыли секрет рыбы, которая плевать хотела на главные законы биологии
100 000 лет успешного клонирования: амазонская моллинезия просто... копирует себя. И при этом удивительно успешно ремонтируют поврежденные гены, насмехаясь над...
Каменный топор со дна реки может переписать древнейшую историю Сибири
По словам ученых, получился отличный научный детектив: добыча золота, артефакт бронзового века, забытая цивилизация...
Почему на Иран обрушился черный дождь и насколько он опасен?
Экологи говорят: агрессивные действия США и Израиля поставили под угрозу здоровье миллионов людей по всей планете...
43 000 черепков открыли тысячелетние тайны Древнего Египта
Почему глиняная библиотека Атрибиса потрясла весь археологический мир?...
Главный секрет человеческого дыхания: ученые рассказали, почему мы дышим «вахтовым методом»
Эксперты предупреждают: из-за особенности организма многие люди не смогут попасть в космос. Но решение все-таки есть...