互联网

网易有道27B开源小模型直接登顶!技术大V:语音克隆功能超强,翻译后毫无外语口语

来源:互联网    作者:      2026年06月15日 09:52

导语:

522日,网易有道宣布,决定将子曰大模型4.0的核心双引擎 ——“多模态模型语音合成(TTS)模型,正式面向全球全量开源。开发者可以免费下载、部署,并基于此进行二次开发。

image.png

其中一个较为引人瞩目的点在于它的【语音克隆】功能。

简单概括这个功能:录一段你说话的声音,AI 就能用你的音色,带着你的情绪,说 14 种语言的任何语句,而且听不出是外国人说的。

对此,一位有着过万关注者的技术大V做出了如下评价:网易有道这不声不响就把子曰4给开源了,27B的参数量,数理能力直接冲到SOTA

不过说实话,我最在意的倒不是这个——而是它的语音克隆能力。

image.png

Labs老早就能做。但有个老毛病一直没人真正解决:跨语种的时候会自带口音。你拿中文声音去讲日语,听着就是个外国人在那儿硬凹,真是尬到脚趾抠地。

子曰4这次就是奔着这个痛点来的——你的声音讲日语,听着就像地道的日本人在说话。3秒就能克隆,覆盖14种语言,做口播配音数字人,省钱又好用。

更关键的是,这回是真开源——人家给的是真权重而不是只给API,整整54G直接让你下,还能本地跑。连有道那个龙虾智能体也一并开源了。

第一,不妨亲自去试试这个语音克隆:传一段你自己的声音,让它说外语,亲耳听听到底带不带口音。

在线试玩:confucius4-tts.youdao.com/gradio

第二,觉得这波开源确实够意思,就去给它点个star支持一下。

多模态模型:https://huggingface.co/netease-youdao/Confucius4

语音模型:https://github.com/netease-youdao/Confucius4-TTShttps://github.com/netease-youdao/Confucius4-TTS


(文章为作者独立观点,不代表艾瑞网立场)
  • 合作伙伴

  • 官方微信
    官方微信

    新浪微博
    邮件订阅
    第一时间获取最新行业数据、研究成果、产业报告、活动峰会等信息。
     关于艾瑞| 业务体系| 加入艾瑞| 服务声明| 信息反馈| 联系我们| 合作伙伴| 友情链接

Copyright© 沪公网安备 31010402000581号沪ICP备15021772号-10

扫一扫,或长按识别二维码

关注艾瑞网官方微信公众号