阿里通义实验室发布多语言语音识别大模型 Fun-ASR1.5

4月20日,阿里通义实验室推出语音识别大模型 Fun-ASR1.5。该模型采用统一架构,可识别全球约30种语言及汉语七大方言与20余种地方口音,在复杂语境(包括古诗词吟诵)下依然保持高精度实时转写能力。Fun-ASR1.5目前已在阿里云百炼平台上线,通过API形式向教育、传媒、金融、科技及文化等行业开放。阿里方面表示,模型将提供高效语音识别服务,支持多场景智能化应用与内容生产提升。

上一篇:

下一篇:

发表回复

登录后才能评论