Ученые СПбГУ улучшили способность нейросети вести диалог

Лингвисты Санкт-Петербургского госуниверситета создали уникальную интонационную модель для нейросетей, которая делает синтезированную речь максимально естественной. Разработка решает главную проблему современных голосовых помощников — «роботизированное» звучание и отсутствие эмоций.
Основой для обучения ИИ стала классификация, созданная фонетистами СПбГУ. Нейросеть научили учитывать мелодику голоса, темп, акценты и смысловые оттенки, что позволяет ей безошибочно передавать интонацию вопроса, просьбы или приказа. Эксперименты с участием добровольцев показали, что люди воспринимают синтезированную речь как живую и легко считывают её подтекст.
Новая технология поможет усовершенствовать голосовых ассистентов и антропоморфных роботов. В планах учёных — добавить искусственному интеллекту ещё больше эмоциональных и стилистических нюансов.
Ранее 78.ru писал, что петербуржцам назвали медианную зарплату в профессиях, где требуются навыки работы с ИИ.




