阿里发布 Qwen-Audio-3.0-ASR-Flash 语音识别模型,医疗词汇听中率超 95%

阿里巴巴发布语音识别大模型 Qwen-Audio-3.0-ASR-Flash,面向专业词汇识别进行优化,强化上下文一致性、行业词识别和热词定制能力,并支持语音润色与结构化文本输出。阿里团队基于医疗、IT 编程、股票、社会名人等领域构建行业词库,内部评测显示,新模型在多行业专业词识别上提升明显,其中医疗场景“听中率”达 95.36%。Qwen-Audio-ASR-Flash 系列已在会议纪要、实时字幕、教育录播、智能客服等场景验证,曾在 Artificial Analysis 评测中以 1.7% 错字率排名第一。目前模型已通过阿里云百炼平台开放调用,提供 Flash、Filetrans 和 Streaming 三个版本。

上一篇:

下一篇:

发表回复

登录后才能评论