阿里巴巴近日宣布,Qwen-Audio-3.0系列语音模型已在千问AI平台全面上线,涵盖语音识别模型Qwen-Audio-3.0-ASR、语音合成模型Qwen-Audio-3.0-TTS和实时语音交互模型Qwen-Audio-3.0-Realtime。官方称,该系列在Artificial Analysis今年7月语音榜单中获ASR、RealTime和TTS三项全球第一。相关模型支持复杂语境识别、多语种多方言合成、情绪语气控制及端到端语音对话,已应用于千问App、千问办公和Qoder等产品。
阿里巴巴近日宣布,Qwen-Audio-3.0系列语音模型已在千问AI平台全面上线,涵盖语音识别模型Qwen-Audio-3.0-ASR、语音合成模型Qwen-Audio-3.0-TTS和实时语音交互模型Qwen-Audio-3.0-Realtime。官方称,该系列在Artificial Analysis今年7月语音榜单中获ASR、RealTime和TTS三项全球第一。相关模型支持复杂语境识别、多语种多方言合成、情绪语气控制及端到端语音对话,已应用于千问App、千问办公和Qoder等产品。