微软自定义神经语音技术已允许用户创建高度逼真、类似于人类的声音

据微软官方发布,近期,Azure 认知服务中的语音服务的一部分——自定义神经语音 (Custom Neural Voice)——文本到语音功能已普遍推出。该功能将允许用户使用微软开创性的神经文本到语音模型,为应用创建高度逼真、类似人类的自定义语音。由于创建的语音非常逼真,微软限制了访问权限,以便用户负责任地使用这项技术。

微软表示,“作为微软对负责任的人工智能承诺的一部分,我们设计和发布自定义神经语音的目的是保护个人和社会的权利,促进透明的人机交互,抵制有害的深层伪装和误导性内容的扩散。为此,我们对自定义神经语音的访问和使用进行了限制。”

IT之家获悉,要创建自定义语音,你只需录制音频并上传作为训练数据即可。Azure 语音服务将为你的录音创建一个独特的语音调整。自定义神经语音的声音逼真自然,可以代表品牌,让用户以自然的方式与应用进行对话互动。

微软强调,以下客户已经在使用这项最新的 TTS 功能。

AT&T / 华纳兄弟:他们最近在德克萨斯州达拉斯的 AT&T 体验店推出了一个首创的创意和互动体验,客户可以直接与兔八哥对话。

Progressive:利用标志性的 Progressive 保险发言人 Flo 的声音,创建了 Flo 聊天机器人,以简化客户咨询流程,提供个性化体验。

Duolingo:为了让学习一门新的语言感到可实现性和适用性,Duolingo 使用课程创建了多样化的风格化声音。

(免责声明:本网站内容主要来自原创、合作媒体供稿和第三方自媒体作者投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。
任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时,应及时向本网站提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明。本网站在收到上述法律文件后,将会依法尽快联系相关文章源头核实,沟通删除相关内容或断开相关链接。 )

赞助商