Перейти к основному контенту
Технологии и медиа⁠,
0

«Яндекс» раскрыл технологию распознавания голосовых команд в шумной среде

Яндекс YDEX ₽4 159 +0,11% Купить
Фото: Андрей Гордеев / Ведомости / ТАСС
Фото: Андрей Гордеев / Ведомости / ТАСС

«Яндекс» представил нейросетевую технологию, позволяющую распознавать голосовые команды даже в условиях сильного фонового шума, сообщили в компании. Решение уже используется в «умных» колонках и ТВ-станциях компании с голосовым помощником «Алиса».

«До сих пор не существовало единого подхода к распознаванию голоса в шумной среде, который был бы одинаково надежен в лабораторных тестах и в реальных условиях», — заявил руководитель направления голосовой активации «Яндекса» Дмитрий Солодуха.

Ключевым элементом технологии является специально разработанный attention-механизм, который одновременно анализирует два звуковых сигнала — один после прохождения через алгоритм эхоподавления, второй — через алгоритм шумоподавления. В каждый момент времени нейросеть выбирает из них тот, где речь распознана наиболее четко. Такой подход позволяет избежать искажений, характерных для традиционного шумоподавления, и обеспечивает устойчивую работу даже в шумной обстановке — например, при включенной музыке, работающем пылесосе или уличных звуках.

«Обычно в «умных» устройствах и ассистентах используют алгоритмы эхоподавления, которые помогают распознать голос на фоне музыки. Уменьшить другие фоновые звуки помогают алгоритмы шумоподавления, но они ухудшают и человеческую речь», — отметили в «Яндексе». Компания также анонсировала научную статью с описанием технологии. Ее авторы выразили надежду, что публикация, в частности, может ускорить прогресс в области голосовых интерфейсов.

«Яндекс» отменил плату за большинство функций нейросети «Алиса»
Технологии и медиа
Фото:Владислав Шатило / РБК

Неделей ранее, 22 июля, в «Яндексе» анонсировали запуск агента на базе искусственного интеллекта для аналитики и визуализации данных — «Нейроаналитика». Новый инструмент позволит находить инсайты, делать выводы на основе таблиц и графиков, а также создавать и редактировать визуализации с помощью запросов на естественном языке.

Агент будет встроен в BI-сервис Yandex DataLens в виде чата и сможет перестраивать графики или менять формулы по пользовательским запросам. В компании ожидают, что инструмент снизит нагрузку на аналитиков и ускорит проверку гипотез и подготовку отчетов примерно на 30%. Первая версия продукта выйдет в сентябре, уже открыт лист ожидания.

Читайте РБК в Telegram.

Авторы
Теги
Магазин исследований Аналитика по теме "Интернет"
Прямой эфир
Ошибка воспроизведения видео. Пожалуйста, обновите ваш браузер.
Лента новостей
Курс евро на 20 января
EUR ЦБ: 90,16 (-0,38)
Инвестиции, 19 янв, 17:49
Курс доллара на 20 января
USD ЦБ: 77,76 (-0,08)
Инвестиции, 19 янв, 17:49
Полиция Кипра раскрыла, когда подтвердят гибель Баумгертнера Общество, 03:01
Самолеты ВС США отправились в Гренландию на фоне угроз Трампа Политика, 02:36
Полиция сообщила о задержаниях после стрельбы на юго-востоке Москвы Общество, 02:15
Аэропорт Самары приостановил полеты Политика, 02:14
В Белгородской области решили разместить пункты обогрева Политика, 01:39
Аэропорты Пензы и Ярославля временно ограничили полеты Политика, 01:21
Politico назвало способы ЕС «прижать» Трампа с «базукой» и картой Китая Политика, 01:16
Как руководителю найти опору?
Узнайте на событии от РБК
Принять участие
Доходность выше ставки: почему фонды денежного рынка так популярны #всенабиржу!, 01:00
На Земле началась магнитная буря на фоне рекордного радиационного шторма Общество, 00:58
Премьер Чехии рассказал о покупке глобуса, чтобы «точно» найти Гренландию Политика, 00:35
На Украине решили создать «антидроновый купол» Политика, 00:17
Детям до 14 лет запретили выезд в Белоруссию и Казахстан по свидетельству Общество, 00:14
ВЦИОМ предложил понять, какое стихотворение написал ИИ Общество, 00:02
«Маги не раскрывают своих секретов»: 80 лет со дня рождения Дэвида Линча Общество, 00:01