Перейти к основному контенту
Технологии и медиа⁠,
0

«Яндекс» раскрыл технологию распознавания голосовых команд в шумной среде

Яндекс YDEX ₽4 159 +0,11% Купить
Фото: Андрей Гордеев / Ведомости / ТАСС
Фото: Андрей Гордеев / Ведомости / ТАСС

«Яндекс» представил нейросетевую технологию, позволяющую распознавать голосовые команды даже в условиях сильного фонового шума, сообщили в компании. Решение уже используется в «умных» колонках и ТВ-станциях компании с голосовым помощником «Алиса».

«До сих пор не существовало единого подхода к распознаванию голоса в шумной среде, который был бы одинаково надежен в лабораторных тестах и в реальных условиях», — заявил руководитель направления голосовой активации «Яндекса» Дмитрий Солодуха.

Ключевым элементом технологии является специально разработанный attention-механизм, который одновременно анализирует два звуковых сигнала — один после прохождения через алгоритм эхоподавления, второй — через алгоритм шумоподавления. В каждый момент времени нейросеть выбирает из них тот, где речь распознана наиболее четко. Такой подход позволяет избежать искажений, характерных для традиционного шумоподавления, и обеспечивает устойчивую работу даже в шумной обстановке — например, при включенной музыке, работающем пылесосе или уличных звуках.

«Обычно в «умных» устройствах и ассистентах используют алгоритмы эхоподавления, которые помогают распознать голос на фоне музыки. Уменьшить другие фоновые звуки помогают алгоритмы шумоподавления, но они ухудшают и человеческую речь», — отметили в «Яндексе». Компания также анонсировала научную статью с описанием технологии. Ее авторы выразили надежду, что публикация, в частности, может ускорить прогресс в области голосовых интерфейсов.

«Яндекс» отменил плату за большинство функций нейросети «Алиса»
Технологии и медиа
Фото:Владислав Шатило / РБК

Неделей ранее, 22 июля, в «Яндексе» анонсировали запуск агента на базе искусственного интеллекта для аналитики и визуализации данных — «Нейроаналитика». Новый инструмент позволит находить инсайты, делать выводы на основе таблиц и графиков, а также создавать и редактировать визуализации с помощью запросов на естественном языке.

Агент будет встроен в BI-сервис Yandex DataLens в виде чата и сможет перестраивать графики или менять формулы по пользовательским запросам. В компании ожидают, что инструмент снизит нагрузку на аналитиков и ускорит проверку гипотез и подготовку отчетов примерно на 30%. Первая версия продукта выйдет в сентябре, уже открыт лист ожидания.

Читайте РБК в Telegram.

Авторы
Теги
Магазин исследований Аналитика по теме "Интернет"
Прямой эфир
Ошибка воспроизведения видео. Пожалуйста, обновите ваш браузер.
Лента новостей
Курс евро на 15 января
EUR ЦБ: 92,2 (-0,2)
Инвестиции, 14 янв, 18:01
Курс доллара на 15 января
USD ЦБ: 78,57 (-0,28)
Инвестиции, 14 янв, 18:01
Знакомый Баумгертнера рассказал об оформлении документов после его смерти Общество, 17:09
FT предупредил об отставании Apple в «дорогой гонке» за ИИ Технологии и медиа, 17:07
Путин заявил, что Россия продолжит добиваться своих целей на Украине Политика, 17:07
Путин назвал игнорирование интересов России причиной конфликта на Украине Политика, 17:05
Путин заявил, что «мир не наступает сам — его строят каждый день» Политика, 17:04
В Запорожской области при атаке дрона погибли два сотрудника аптеки Общество, 17:00
Главный актив года: стратегии ведущих управляющих на рынке ОФЗ #всенабиржу!, 17:00
ИИ для работы и жизни — интенсив РБК
Как пользоваться нейросетями и прокачать с ними общение
Подробнее
Путин заявил о деградации ситуации на международной арене Политика, 16:58
Минэкономики напомнило россиянам о мерах предосторожности в Иране Общество, 16:57
Вице-премьер назвал задачи оперштаба по борьбе с кибермошенничеством Политика, 16:52
Bloomberg рассказал, что «сибирский взрыв» грозит не только погоде Европы Общество, 16:49
Допущенный на Игры ски-альпинист Филиппов впервые взял медаль Кубка мира Спорт, 16:48
Монетизация данных о клиентах: норма или повод для паники РБК и PostgresPro, 16:46
Ельцин-центр убрал упоминания Ройзмана, Макаревича и других иноагентов Политика, 16:42