第一步
第二步
第三步
第四步
第五步
//弹窗容器

中国电信发布首个支持30种方言混说语音大模型

2024-05-25 14:54    来源: 云财经    影响力评估指数:23.28  
相关股票:
云财经讯,近日,中国电信(601728)人工智能(161631)研究院发布了业内首个支持30种方言自由混说的语音识别大模型——星辰超多方言语音识别大模型。这一突破打破了单一模型只能识别特定单一方言的限制,可同时识别理解粤语、上海话、四川话、温州话等30多种方言,是国内支持最多方言的语音识别大模型。据悉,该大模型研发团队首创“蒸馏+膨胀”联合训练算法,解决了预训练坍缩的问题,实现了1B参数80层模型的稳定训练。星辰语音大模型也是业内首个开源的基于离散语音表征的语音识别大模型,通过“从语音到token再到文本”的建模新范式,将推理时语音传输比特率降低数十倍。目前,星辰语音大模型已在福建、江西、广西、北京、内蒙等地的中国电信(601728)万号智能客服试点应用。
云财经智能匹配相关概念