OpenAI推出声音克隆新技术:复刻你的声音仅需15秒

互联网 来源:快科技 2024-03-31 15:59:33

据媒体报道,OpenAI公司最近推出了一项革命性的声音克隆技术——“Voice Engine”。

据悉,Voice Engine通过文本输入和15秒的音频样本,便能生成与原始说话者声音极为相似、情感丰富且自然逼真的语音。

这一技术的研发始于2022年,并已应用于公司现有的文本转语音API和Read Aloud功能中的预设语音。

OpenAI认为,Voice Engine技术对于多个领域具有重大意义。在阅读辅助和语言翻译方面,它能够提供更为自然的语音输出,增强用户体验。

同时,该技术对于言语障碍患者来说更是一大福音,能够帮助他们更顺畅地交流。例如,在布朗大学的一个试点项目中,该技术成功用于创建从学校项目录制的音频中提取的语音克隆,有效帮助了言语障碍学生。

然而,鉴于合成语音技术可能存在的滥用风险,OpenAI目前仅对少数可信合作伙伴开放小规模测试。通过这种方式,公司旨在深入了解技术的潜在应用,并评估可能带来的风险。

OpenAI也希望通过此举引发社会对合成语音负责任部署的广泛讨论,共同探索如何适应这一新型技术。

此外,为了确保技术的安全使用,OpenAI还采取了一系列安全措施。这些措施包括使用水印技术追踪音频来源,以及对系统的使用方式进行主动监控。

当产品正式推向市场时,公司将设立一个“禁止语音列表”,以检测并阻止与名人声音过于相似的人工智能生成声音,从而避免潜在的版权和隐私问题。

延伸阅读
  • 实测ChatGPT最新搜索功能 真的很好用

    当地时间10月31日,OpenAI正式上线ChatGPT搜索功能,向谷歌发起挑战。OpenAI官方介绍称,ChatGPT Search支持实时网络搜索,为用户提供快速、及时的最新资讯和答案,无需再借助

  • ChatGPT搜索功能强势来袭:谷歌能否保住搜索霸权

    当地时间周四,OpenAI在官网宣布,其在ChatGPT中推出了搜索功能,“可以通过相关网络资源的链接获得快速、及时的答案。”OpenAI称,新的搜索功能不仅具有自然语言界面的优势,还结合了体育、新闻

  • 安全政策遭质疑 OpenAI解散AGI团队

    每经AI快讯,据媒体报道,OpenAI正在解散其“AGI筹备”团队,该团队就OpenAI自身处理日益强大的人工智能的能力以及世界管理该技术的准备情况向公司提供建议。周三,AGI筹备团队高级顾问Mile

关注公众号:拾黑(shiheibook)了解更多

友情链接:

关注数据与安全,洞悉企业级服务市场:https://www.ijiandao.com/
安全、绿色软件下载就上极速下载站:https://www.yaorank.com/

公众号 关注网络尖刀微信公众号
随时掌握互联网精彩
赞助链接