当前位置: 首页 » 资讯 » 科技头条 » 正文

腾讯发布语音识别模型Hy ASR 3.0 preview:中文普通话词错误率为3.34%

IP属地 中国·北京 编辑:刘敏 凤凰网科技 时间:2026-08-04 18:50:07

8月4日,腾讯混元发布新一代语音识别模型Hy ASR 3.0 preview。该模型基于最新大语言模型Hy3,融合语音识别与深度语义理解,旨在从“逐字转写”演进为“理解语境、兼容场景”。在开源评测集中,Hy ASR 3.0 preview的中文普通话WER(词错误率)为3.34%,英语为2.62%,粤语为3.12%。

技术层面,模型采用MoE架构,基座模型升级为Hy3,自研无监督语音Encoder通过数千万小时级语音数据训练,并引入多阶段强化学习优化。Hy ASR 3.0重点提升了通用识别、上下文意图理解(如智能纠错同音词)、专词识别(支持热词注入)及复杂声学环境(高噪、耳语)下的稳定性。

目前该模型已上线腾讯云提供API服务,元宝已首发上线并免费开放方言识别、上下文纠错等功能,WorkBuddy等产品也在陆续接入中。

标签: 模型 语音识别 上下文 hy3 纠错 语义 粤语

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。

全站最新