千问9月18日上线新一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频、视频输入和 1M 长上下文,已在千问 AI 平台开放体验。模型面向音视频 Agent 工作流,覆盖视频剪辑、MV 创作、影视制作、音视频摘要与对话等场景。官方称,其在30项评测中较 Qwen3.5-Omni-Plus 平均提升超26%,音视频能力接近 Gemini3.8 Flash,音频能力整体超过后者;API 音频输入价格降幅超98%,音视频输入降幅超93%。同步扩展 Qwen-MM-Plugins 并开源 Qwen-Live Harness,Realtime 版本支持“听声辨位”。