Перейти к основному контенту
Технологии и медиа⁠,
0

«Яндекс» раскрыл технологию распознавания голосовых команд в шумной среде

Яндекс YDEX ₽4 159 +0,11% Купить
Фото: Андрей Гордеев / Ведомости / ТАСС
Фото: Андрей Гордеев / Ведомости / ТАСС

«Яндекс» представил нейросетевую технологию, позволяющую распознавать голосовые команды даже в условиях сильного фонового шума, сообщили в компании. Решение уже используется в «умных» колонках и ТВ-станциях компании с голосовым помощником «Алиса».

«До сих пор не существовало единого подхода к распознаванию голоса в шумной среде, который был бы одинаково надежен в лабораторных тестах и в реальных условиях», — заявил руководитель направления голосовой активации «Яндекса» Дмитрий Солодуха.

Ключевым элементом технологии является специально разработанный attention-механизм, который одновременно анализирует два звуковых сигнала — один после прохождения через алгоритм эхоподавления, второй — через алгоритм шумоподавления. В каждый момент времени нейросеть выбирает из них тот, где речь распознана наиболее четко. Такой подход позволяет избежать искажений, характерных для традиционного шумоподавления, и обеспечивает устойчивую работу даже в шумной обстановке — например, при включенной музыке, работающем пылесосе или уличных звуках.

«Обычно в «умных» устройствах и ассистентах используют алгоритмы эхоподавления, которые помогают распознать голос на фоне музыки. Уменьшить другие фоновые звуки помогают алгоритмы шумоподавления, но они ухудшают и человеческую речь», — отметили в «Яндексе». Компания также анонсировала научную статью с описанием технологии. Ее авторы выразили надежду, что публикация, в частности, может ускорить прогресс в области голосовых интерфейсов.

«Яндекс» отменил плату за большинство функций нейросети «Алиса»
Технологии и медиа
Фото:Владислав Шатило / РБК

Неделей ранее, 22 июля, в «Яндексе» анонсировали запуск агента на базе искусственного интеллекта для аналитики и визуализации данных — «Нейроаналитика». Новый инструмент позволит находить инсайты, делать выводы на основе таблиц и графиков, а также создавать и редактировать визуализации с помощью запросов на естественном языке.

Агент будет встроен в BI-сервис Yandex DataLens в виде чата и сможет перестраивать графики или менять формулы по пользовательским запросам. В компании ожидают, что инструмент снизит нагрузку на аналитиков и ускорит проверку гипотез и подготовку отчетов примерно на 30%. Первая версия продукта выйдет в сентябре, уже открыт лист ожидания.

Читайте РБК в Telegram.

Авторы
Теги
Магазин исследований Аналитика по теме "Интернет"
Прямой эфир
Ошибка воспроизведения видео. Пожалуйста, обновите ваш браузер.
Лента новостей
Курс евро на 17 февраля
EUR ЦБ: 91,04 (-0,52)
Инвестиции, 18:02
Курс доллара на 17 февраля
USD ЦБ: 76,62 (-0,57)
Инвестиции, 18:02
Мошенники начали предлагать уборку снега и исчезать после предоплаты Общество, 23:30
Зеленский ввел санкции против Дворковича и девяти российских спортсменов Спорт, 23:16
Белый дом фразой про жертву и охотника поздравил Трампа с праздником Политика, 23:07
«Люблю запах напалма поутру». Какими ролями прославился Роберт Дюваль Общество, 22:55
Трехсторонние переговоры в Женеве закрыли для прессы Политика, 22:52
Суд взыскал с Google Ireland более ₽160 млрд в пользу российской «дочки» Бизнес, 22:44
Вслед за Геленджиком и Краснодаром для полетов закрыли аэропорт Сочи Политика, 22:35
Звезды маркетплейсов
Топ-100 продавцов на Wildberries и Ozon
Подробнее
Bloomberg узнал об участии фирм Маска в секретном тендере на рой дронов Технологии и медиа, 22:29
Мосгорсуд вернул Центру Рерихов 272 конфискованные картины Общество, 22:21
Axios узнал об угрозе Пентагона разорвать контракт на ИИ с Anthropic Политика, 22:17
Тутберидзе заявили тренером Петросян на Олимпийских играх в Италии Спорт, 22:06
Венгерская MOL обратилась к властям из-за остановки поставок по «Дружбе» Политика, 21:59
Шесть критериев качества жизни в новостройке РБК и ПИК, 21:52
Впервые мать и сын выступили на одной Олимпиаде. Что происходит на Играх Спорт, 21:36