凤凰网科技讯 8月4日,腾讯混元发布新一代语音识别模型Hy ASR 3.0 preview。该模型基于最新大语言模型Hy3,融合语音识别与深度语义理解,旨在从“逐字转写”演进为“理解语境、兼容场景”。在开源评测集中,Hy ASR 3.0 preview的中文普通话WER(词错误率)为3.34%,英语为2.62%,粤语为3.12%。

技术层面,模型采用MoE架构,基座模型升级为Hy3,自研无监督语音Encoder通过数千万小时级语音数据训练,并引入多阶段强化学习优化。Hy ASR 3.0重点提升了通用识别、上下文意图理解(如智能纠错同音词)、专词识别(支持热词注入)及复杂声学环境(高噪、耳语)下的稳定性。
目前该模型已上线腾讯云提供API服务,元宝已首发上线并免费开放方言识别、上下文纠错等功能,WorkBuddy等产品也在陆续接入中。
本文转自:凤凰网科技
原文地址: https://tech.ifeng.com/c/8vJkzhCPhCH

小同爱分享3 个月前
命没了还有轮回,钱没了,死都不甘心。 - 小同爱分享
小同爱分享6 个月前
疫情,就是让人抑郁,又没了感情。 - 小同爱分享