Перейти к основному контенту
Технологии и медиа⁠,
0

«Яндекс» раскрыл технологию распознавания голосовых команд в шумной среде

Яндекс YDEX ₽4 159 +0,11% Купить
Фото: Андрей Гордеев / Ведомости / ТАСС
Фото: Андрей Гордеев / Ведомости / ТАСС

«Яндекс» представил нейросетевую технологию, позволяющую распознавать голосовые команды даже в условиях сильного фонового шума, сообщили в компании. Решение уже используется в «умных» колонках и ТВ-станциях компании с голосовым помощником «Алиса».

«До сих пор не существовало единого подхода к распознаванию голоса в шумной среде, который был бы одинаково надежен в лабораторных тестах и в реальных условиях», — заявил руководитель направления голосовой активации «Яндекса» Дмитрий Солодуха.

Ключевым элементом технологии является специально разработанный attention-механизм, который одновременно анализирует два звуковых сигнала — один после прохождения через алгоритм эхоподавления, второй — через алгоритм шумоподавления. В каждый момент времени нейросеть выбирает из них тот, где речь распознана наиболее четко. Такой подход позволяет избежать искажений, характерных для традиционного шумоподавления, и обеспечивает устойчивую работу даже в шумной обстановке — например, при включенной музыке, работающем пылесосе или уличных звуках.

«Обычно в «умных» устройствах и ассистентах используют алгоритмы эхоподавления, которые помогают распознать голос на фоне музыки. Уменьшить другие фоновые звуки помогают алгоритмы шумоподавления, но они ухудшают и человеческую речь», — отметили в «Яндексе». Компания также анонсировала научную статью с описанием технологии. Ее авторы выразили надежду, что публикация, в частности, может ускорить прогресс в области голосовых интерфейсов.

«Яндекс» отменил плату за большинство функций нейросети «Алиса»
Технологии и медиа
Фото:Владислав Шатило / РБК

Неделей ранее, 22 июля, в «Яндексе» анонсировали запуск агента на базе искусственного интеллекта для аналитики и визуализации данных — «Нейроаналитика». Новый инструмент позволит находить инсайты, делать выводы на основе таблиц и графиков, а также создавать и редактировать визуализации с помощью запросов на естественном языке.

Агент будет встроен в BI-сервис Yandex DataLens в виде чата и сможет перестраивать графики или менять формулы по пользовательским запросам. В компании ожидают, что инструмент снизит нагрузку на аналитиков и ускорит проверку гипотез и подготовку отчетов примерно на 30%. Первая версия продукта выйдет в сентябре, уже открыт лист ожидания.

Читайте РБК в Telegram.

Авторы
Теги
Магазин исследований Аналитика по теме "Интернет"
Прямой эфир
Ошибка воспроизведения видео. Пожалуйста, обновите ваш браузер.
Лента новостей
Курс евро на 17 января
EUR ЦБ: 90,54 (-1,28)
Инвестиции, 16 янв, 18:04
Курс доллара на 17 января
USD ЦБ: 77,83 (-0,7)
Инвестиции, 16 янв, 18:04
Эксперты оценили последствия ситуации вокруг Гренландии для НАТО и ЕС
РАДИО
Политика, 03:11
Последствия «гречневого перепроизводства» в России. Инфографика Экономика, 03:00
Эрдоган пообещал поддерживать Сирию в борьбе с терроризмом Политика, 02:58
Президент Сирии подписал соглашение о прекращении огня с курдами Политика, 02:35
Умер один из режиссеров мультфильма «Король Лев» Роджер Аллерс Политика, 02:26
МИД Дании счел ожидаемые пошлины США невозможными в современном мире Политика, 02:05
JP сообщил, что авианосец США вошел в Малаккский пролив на пути к Ирану Политика, 01:42
Как руководителю найти опору?
Узнайте на событии от РБК
Принять участие
Сборная Сенегала победила Марокко в финале Кубка африканских наций Спорт, 01:31
Аэропорт Саратова приостановил полеты Политика, 01:21
В Пензенской области ввели план «Ковер» Политика, 01:19
ЕС проведет внеочередной саммит на фоне угроз США ввести пошлины Политика, 01:05
Доходность выше ставки: почему фонды денежного рынка так популярны #всенабиржу!, 01:00
В Испании выросло число погибших при сходе с рельсов двух поездов Общество, 00:53
FT узнала, что в Давосе помимо Украины решили обсудить и Гренландию Политика, 00:43