Исследователи СпбГУ доработали языковую модель по части ведения диалога
- 1370
- 1 мин.
- 1 связь
Лингвистам СпбГУ удалось усовершенствовать способности ИИ вести диалог. Нового качества ученые добились путем внедрения в нейросеть интонационной модели, сообщила пресс-служба вуза.
Посредством интонаций при общении люди определяют коммуникативное содержание сказанного: отличают вопросы от повествовательной информации и восклицаний. Нейросетевые голосовые помощники уже способны вести диалог, но без интонирования — важного элемента речевой коммуникации, говорится в сообщении.
Разработка исследователей СпбГУ решает проблему монотонного и неестественного воспроизведения текстовой информации голосовыми помощниками. Для обучения нейросети Tacotron2 лингвисты использовали специальным образом размеченный материал, учитывающий акустические признаки. Основой обучения стала разработанная лингвистами университета интонационная классификация, включающая широкий спектр интонационных вариантов: от повествования, вопроса, обращения и просьбы до восклицания, требования и приказа.
Исследования усовершенствованной модели с привлечением добровольцев продемонстрировали, что синтезированная речь людям кажется живой, и они без труда улавливают скрытый подтекст. В планах разработчиков — добавление в интеллектуальный голосовой синтезатор больше эмоциональных и стилистических оттенков.
Компании1 в новости
Рейтинг компаний
Общественная редакция в Санкт-Петербурге
- Запросами в любые органы власти местного и федерального уровня;
- Экспертными мнениями о проблеме у тематических спикеров.
Потапова Алёна Директор по развитию










