Перейти к основному контенту
Технологии и медиа⁠,
0

«Яндекс» раскрыл технологию распознавания голосовых команд в шумной среде

Яндекс YDEX ₽4 159 +0,11% Купить
Фото: Андрей Гордеев / Ведомости / ТАСС
Фото: Андрей Гордеев / Ведомости / ТАСС

«Яндекс» представил нейросетевую технологию, позволяющую распознавать голосовые команды даже в условиях сильного фонового шума, сообщили в компании. Решение уже используется в «умных» колонках и ТВ-станциях компании с голосовым помощником «Алиса».

«До сих пор не существовало единого подхода к распознаванию голоса в шумной среде, который был бы одинаково надежен в лабораторных тестах и в реальных условиях», — заявил руководитель направления голосовой активации «Яндекса» Дмитрий Солодуха.

Ключевым элементом технологии является специально разработанный attention-механизм, который одновременно анализирует два звуковых сигнала — один после прохождения через алгоритм эхоподавления, второй — через алгоритм шумоподавления. В каждый момент времени нейросеть выбирает из них тот, где речь распознана наиболее четко. Такой подход позволяет избежать искажений, характерных для традиционного шумоподавления, и обеспечивает устойчивую работу даже в шумной обстановке — например, при включенной музыке, работающем пылесосе или уличных звуках.

«Обычно в «умных» устройствах и ассистентах используют алгоритмы эхоподавления, которые помогают распознать голос на фоне музыки. Уменьшить другие фоновые звуки помогают алгоритмы шумоподавления, но они ухудшают и человеческую речь», — отметили в «Яндексе». Компания также анонсировала научную статью с описанием технологии. Ее авторы выразили надежду, что публикация, в частности, может ускорить прогресс в области голосовых интерфейсов.

«Яндекс» отменил плату за большинство функций нейросети «Алиса»
Технологии и медиа
Фото:Владислав Шатило / РБК

Неделей ранее, 22 июля, в «Яндексе» анонсировали запуск агента на базе искусственного интеллекта для аналитики и визуализации данных — «Нейроаналитика». Новый инструмент позволит находить инсайты, делать выводы на основе таблиц и графиков, а также создавать и редактировать визуализации с помощью запросов на естественном языке.

Агент будет встроен в BI-сервис Yandex DataLens в виде чата и сможет перестраивать графики или менять формулы по пользовательским запросам. В компании ожидают, что инструмент снизит нагрузку на аналитиков и ускорит проверку гипотез и подготовку отчетов примерно на 30%. Первая версия продукта выйдет в сентябре, уже открыт лист ожидания.

Читайте РБК в Telegram.

Авторы
Теги
Магазин исследований Аналитика по теме "Интернет"
Прямой эфир
Ошибка воспроизведения видео. Пожалуйста, обновите ваш браузер.
Лента новостей
Курс евро на 14 января
EUR ЦБ: 92,4 (+0,43)
Инвестиции, 13 янв, 18:09
Курс доллара на 14 января
USD ЦБ: 78,85 (+0,06)
Инвестиции, 13 янв, 18:09
Структурные облигации: возможности и риски для инвесторов #всенабиржу!, 16:15
Дума одобрила в 1-м чтении проект о праве управдомов уходить в отставку Недвижимость, 16:14
Гуф вновь не признал вину по делу о краже iPhone в подмосковной бане Общество, 16:12
В «Ростове» объяснили трансферный запрет со стороны ФИФА Спорт, 16:11
«Росатом» заблокировал смену гендиректора управляющей компании «Дело» Бизнес, 16:11
Дания направила в Гренландию солдат и военную технику Политика, 16:08
ФИФА запретила «Ростову» регистрировать новых футболистов Спорт, 16:01
Определите свой тип лидерства
Это займет всего 5 минут
Пройти тест
Военная операция на Украине. Онлайн Политика, 15:59
Власти предложили ограничить расходы внесенных в перечень экстремистов Политика, 15:57
Стейблкоин проекта Трампов попробуют официально внедрить в Пакистане Крипто, 15:52
Умер прошедший Великую Отечественную войну актер Виктор Рухманов Общество, 15:49
6 самых дорогих ошибок при выборе специалиста на аутсорс Образование, 15:41
Главные факты из биографии актера Игоря Золотовицкого 15:40
Лавров отметил готовность Москвы к контактам с Уиткоффом и Кушнером Политика, 15:33