«Сбер» ведет разработку нового метода функционирования голосового ИИ. Full Duplex — модели смогут одновременно и слушать, и говорить.
При необходимости нейросеть отреагирует на то, что слышит. В видеомодальности модель увидит собеседника и будут управлять движениями цифрового аватара.
В отличие от существующих систем (к примеру, GigaChat Audio), представляющих собой каскад нейросетей для поочередного выполнения задач распознавания и синтеза речи, Full Duplex — системы представляют собой единую модель. Их разработке поспособствовало появление новых методов анализа звука, усовершенствованных архитектур и больших объемов данных аудиозаписей и диалогов для обучения.
Среди потенциальных областей применения Full Duplex — моделей называются умные колонки, роботы, в том числе антропоморфные, иммерсивные реалистичные аватары (IRA), а также ИИ-ассистенты для парного программирования. Предполагается, что первые наработки «Сбер» представит в ноябре 2026 года.
«Сбер» представил обновленную нейросеть GigaChat Audio в июле 2026 года.
#искусственный_интеллект#генеративный_ИИ#нейросети#распознавание_речи#синтез_речи
Компании:Нажимая на кнопку, вы соглашаетесь с политикой конфиденциальности
ICT.Moscow — открытая площадка о цифровых технологиях в Москве. Мы создаем наиболее полную картину развития рынка технологий в городе и за его пределами, помогаем бизнесу следить за главными трендами, не упускать возможности и находить новых партнеров.