云知声完成U2系列语音大模型升级,覆盖多语种出海场景
近期,云知声在港交所发布公告,宣布旗下U2-ASR
语音识别
大模型与U2-TTS语音合成大模型已完成全面能力升级。这次升级没有停留在对原有中文识别效果的小修小补上,而是针对性拓展了大量海外语种的适配能力,直接覆盖欧洲、东南亚、中东、拉美等多个重点出海市场,给有跨语种语音交互需求的企业,提供了更顺手的技术支撑。不少正在布局海外业务的国内企业,已经开始跟进这次升级后的落地效果,准备把新能力接入自己的海外产品里。
很多做海外业务的从业者都有过类似的头疼经历:想给海外用户做语音交互功能,找遍市面上的语音技术方案,要么只能支持英语、日语这类主流语种,很多小众国家的语言识别准确率特别低,连当地用户的日常对话都转写不对;要么语音合成出来的语调特别生硬,带着明显的机器翻译腔,当地用户听着特别别扭,根本不愿意用。云知声这次升级的U2系列语音大模型,就是专门瞄准这些出海痛点,把大量之前覆盖不到的语种做了深度适配,补上了很多细分市场的语音交互短板。
这次升级后的U2-ASR语音识别大模型,一口气新增了13种国际语言的识别能力。这些新增的语种不是随便凑数的浅度适配,每一种都针对当地的日常口语表达习惯、方言口音做了大量数据训练。比如东南亚部分国家的语言里,夹杂了大量当地特色的俚语和外来词汇,之前很多通用语音识别方案根本认不出来,现在升级后的U2-ASR,能精准识别当地用户的日常对话,哪怕用户带着点地方口音,也能把语音内容准确转写成对应的文字,不会出现识别出来的内容完全读不通的情况。
同步升级的U2-TTS语音合成大模型,新增了8种东南亚语言的语音合成能力。很多人之前接触过的小语种语音合成,读出来的内容语调平得像
机器人
,断句完全不符合当地语言的表达习惯,听久了特别别扭。这次升级后的U2-TTS,专门邀请了大量当地的母语主播录制训练素材,合成出来的语音语调自然流畅,断句和重音都符合当地用户的日常说话习惯,甚至能适配不同的使用场景,既可以生成适合导航播报的清晰沉稳音色,也能生成适合智能客服的亲切活泼音色,当地用户听着完全没有生硬的机器感。
从实际落地的场景来看,这次升级能帮很多出海企业解决不少之前卡壳的问题。比如做跨境出行导航的企业,之前在部分东南亚、拉美国家,找不到适配当地小语种的高质量语音导航方案,只能用英语播报,很多当地普通用户根本听不懂,现在接入升级后的U2系列语音大模型,就能直接生成当地母语的导航语音,用户用起来顺手很多。做跨境电商智能客服的企业,之前很多小语种的用户咨询,只能靠人工客服回复,效率低成本高,现在用升级后的语音识别转写用户的咨询内容,再用语音合成生成回复,就能直接实现小语种的智能语音客服,不用投入大量懂小众语言的人工坐席。
不少提前试用了这次升级版本的出海企业都反馈,之前找遍全球都很难找到能同时覆盖这么多细分语种、效果还能达标的语音技术方案。云知声这次的U2系列语音大模型升级,刚好踩中了很多企业出海的实际需求点。目前升级后的全能力版本已经正式对外开放接入,后续会有更多面向全球市场的
智能硬件
、出行、电商产品,用上这套适配多语种的语音交互能力,给不同国家和地区的用户带来更自然的语音交互体验。
硬件
硬件
+关注
关注
13
文章
3806
浏览量
69925
智能语音
智能语音
+关注
关注
11
文章
836
浏览量
50488
云知声
云知声
+关注
关注
0
文章
351
浏览量
9639
大模型
大模型
+关注
关注
2
文章
4133
浏览量
5581
