财经 > 财经滚动新闻 > 正文

中国电信发布首个支持30种方言混说语音大模型

财联社

下载客户端
独家抢先看

2024年05月25日 15:35:03 来自北京

【中国电信发布首个支持30种方言混说语音大模型】财联社5月25日电，近日，中国电信人工智能研究院发布业内首个支持30种方言自由混说的语音识别大模型——星辰超多方言语音识别大模型，打破单一模型只能识别特定单一方言的困境，可同时识别理解粤语、上海话、四川话、温州话等30多种方言，是国内支持最多方言的语音识别大模型。据悉，该大模型研发团队首创“蒸馏+膨胀”联合训练算法，解决超大规模多场景数据集和大规模参数条件下，预训练坍缩的问题，实现1B参数80层模型稳定训练。星辰语音大模型也是业内首个开源的基于离散语音表征的语音识别大模型，通过“从语音到token再到文本”的建模新范式，将推理时语音传输比特率降低数十倍。目前，星辰语音大模型已在福建、江西、广西、北京、内蒙等地的中国电信万号智能客服试点应用。

“特别声明：以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布，本平台仅提供信息存储空间服务。

Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”

中国电信发布首个支持30种方言混说语音大模型

亲爱的凤凰网用户:

第三方浏览器推荐: