时间:2019-04-04 来源:u小马 访问:次
今天微软小冰宣布,小冰的AI歌唱模型技术重大升级。据悉,这是AI科技史上的首次,可以像人类歌手那样,用充沛的中气演唱。
微软(亚洲)互联网工程院表示,微软小冰基于深度神经网络的歌唱模型,已顺利完成V5新版本的研发。新的V5模型实现了重大突破,它使微软小冰第一次能够像人类歌手一样,使用充沛的“中气”来烘托演唱,从而将人工智能虚拟歌声质量提升至新的高度。此外,该模型不仅限于优化微软小冰的声音,还支持对任何人类歌手的声线进行学习、模拟和建模,演绎与再现歌手们巅峰状态下的演唱水平。作为技术示例,微软与日本唱片公司AVEX合作发行的新模型DEMO曲《最高新记忆》,也于今天同时公布。
微软(亚洲)互联网工程院分享了深度神经网络歌唱模型方面的最新进展。中国古时不乏对音乐之声的精辟论述,例如“丝(丝弦乐器)不如竹(管乐器),竹不如肉(人声)”,为其“渐进自然”。因此,微软把不断趋近人类歌手的声音合成质量,视为“人工智能创造”分支的最高技术目标。在上一个版本中,实现了小冰在虚拟演唱中的自然换气。今天推出的新版本,则进一步将“气息”应用于演唱全过程,使生成的歌声接近专业人类歌手,并可预测并自由切换演唱技巧,突破了传统单元拼接技术音高与音准的“软件乐器”标准。微软用DEMO曲来表现这一技术对照的明显差距,请重点关注歌曲时间轴上的以下时刻:
00:31,01:12,01:23,03:14,04:08