Российская технология распознавания речи группы компаний ЦРТ Сбербанка признана лучшей в мире

Ольга Шарипова   
12.05.2020 22:10

Технология сегментирования аудиопотока (диаризации) и распознавания речи, созданная группой компаний ЦРТ (входит в экосистему Сбербанка), признана лучшей на международном конкурсе CHiME Speech Separation and Recognition Challenge (CHiME-6).

Высокое признание технология получила за распознавание английской речи с нескольких микрофонов в условиях естественной обстановки.

Как сообщает пресс-служба Сбербанка, группа ЦРТ показала наилучшие результаты тестов в самой сложной задаче конкурса, значительно превзойдя конкурентов.

Организаторы CHiME предлагают сильнейшим командам со всего мира различные задачи, которые с каждым новым конкурсом усложняются. На CHiME-5, конкурсанты решали так называемую cocktail party problem – распознавание спонтанной речи нескольких дикторов в условиях частичного наложения речи и шума, то есть в типичной ситуации общения на вечеринке. Этот блок требовал работы с сегментированной (уже выделенной) речью. Новизна и особенность CHiME-6 заключалась в том, что впервые в истории конкурсантам было предложено решить аналогичную проблему, но работая с несегментированной речью, при этом – с перекрытием речи до 20%. Именно на решении этой – самой сложной – задачи сфокусировалась команда ЦРТ.

Записи для конкурса были сделаны на 20 ужинах в реальных домах на вечеринках, где люди готовили, ели, мыли посуду, свободно и эмоционально общались, шутили и смеялись. Распознавание речи здесь осложняет одновременная речь 2-4 человек, реверберация и интенсивный шум: звон приборов, льющаяся из крана вода, гул кондиционера, шаги, смех.

Цель участников – создать систему распознавания, которая «прослушает» записи и выдаст полную расшифровку с наименьшим количеством ошибок. Команда группы ЦРТ заняла первое место.

Для этого был разработан уникальный алгоритм выделения речевых сегментов для каждого из дикторов, а также создан комплекс из нескольких нейронных сетей разных архитектур, различающий разных дикторов, реализующий бимформинг (эффект нацеливания микрофонов на конкретного диктора) и непосредственно распознающий речь.

Кроме группы ЦРТ в конкурсе участвовали научные команды со всего мира: и известные IT-компании (Toshiba и ряд других), и крупные университеты-лидеры в области речевых технологий: Университет Джонса Хопкинса (США), Университет науки и технологии Китая, Технический университет Брно (Чехия) и др.

– Группа ЦРТ уже 30 лет создает, развивает и совершенствует речевые технологии. В этом году на CHiME-6 впервые в истории стояла самая сложная задача – работа с несегментированной речью. Качественное распознавание речи разных дикторов, при этом перебиваемой шумами, позволяет выводить сервисы из разряда инновационных в повседневное применение, совершенствуя бизнес и упрощая нашу жизнь, – отметил генеральный директор группы компаний ЦРТ Дмитрий Дырмовский.

Он заявил, что качественная обработка несегментированной речи позволит, к примеру, вести грамотное протоколирование совещаний, где говорит сразу несколько спикеров, а интеллектуальная речевая аналитика позволит автоматизировать работу контактных центров: распознавать спонтанную речь, классифицировать голосовые обращения, выявлять соблюдения скрипта, делать выводы об удовлетворенности клиента и качестве диалога, а значит – существенно оптимизировать работу современных контакт-центров ретейла, e-commerce и телеком.

– Признание группы ЦРТ в этом международном конкурсе – не просто наша личная победа, но знаковое событие для всей индустрии, и мы рады выводить решение задач в области распознавания речи, над которыми работают сильнейшие команды со всего мира, на новый уровень, достойно представляя свои ключевые компетенции на глобальном рынке, – продолжил Дмитрий Дырмовский.

– Задача CHiME – обеспечить обмен опытом сильнейших команд со всего мира и продвинуть вперед решение глобальных задач в области распознавания речи. И мы приветствуем достижения группы компаний ЦРТ в этой области, – выразил свое мнение представитель Университета Шеффилд, участник организационного комитета CHiME Challenge Джон Баркер.

Новости компаний

Сбер: мошенники представляются полицейскими, получают доступ к Госуслугам и берут займы в МФО

Мошенники усовершенствовали схему, при реализации которой они получают кредиты в микрофинансовых организациях с помощью учётной записи людей на Госуслугах. Теперь злоумышленники начали совершать видеозвонки и предъявлять поддельные документы, сообщает пресс-служба Сбера.

 
Завод по производству ЖБИ для панельных домов строят в Чите, он обеспечит 120 рабочих мест

В Чите строится новый завод «Новин» по производству железобетонных изделий для крупнопанельных домов. Он обеспечит больше 120 рабочих мест. Этот проект финансирует проект Сбер, сообщает пресс-служба банка.

 
Сбер: 22 автомобиля УАЗ с дезинфекционными установками приобрел департамент ветеринарии Якутии

Автопарк департамента ветеринарии республики Саха (Якутия) пополнили 22 автомашины с дезинфекционными установками на базе автомобилей УАЗ. Об этом сообщает пресс-служба Сбера.

 
Жители Иркутска, Братска, Улан-Удэ, Читы и Якутска могут принять участие в забеге 1 июня, сообщает Сбер

В Иркутске, Братске, Улан-Удэ, Чите и Якутске спортивно-благотворительный праздник пройдёт 1 июня – в День защиты детей. Подать заявку на участие в забеге можно до 26 мая, сообщает пресс-служба Сбера.

 
Более 140 млн рублей выплатила компания «СберСтрахование жизни» заемщикам из Иркутской области с начала года

«СберСтрахование жизни» в январе-марте 2024 года оказало финансовую поддержку застрахованным заёмщикам из Иркутской области, выплатив по страховым случаям 140,7 миллиона рублей. Компания урегулировала 906 страховых событий, сообщает пресс-служба Сбера.

Метки:
 

История Оксаны Костиной, художественная гимнастика

Видеосюжеты
Сергей Шмидт: Срок