阿里发布 Qwen3.8-Omni-Flash,支持百万上下文全模态输入

阿里巴巴 Qwen 团队发布原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频、视频输入,提供最高100万 Token 上下文窗口,官方称较 Qwen3.5-Omni-Plus 在29项基准测试中平均提升超25%。模型强化音频与音视频理解、工具调用和智能体能力,支持113种语言和方言、双声道及四声道音频分析。阿里称其音频输入估算成本每小时下降超98%,音频加视频下降超93%。该模型已通过阿里云百炼在北京、新加坡、香港、东京、法兰克福、弗吉尼亚等区域提供服务,暂未开放权重。

上一篇:

下一篇:

发表回复

登录后才能评论