阿里千问团队发布多模态MoE模型Qwen3.8-Flash,并开源下一代底层架构Qwen3.8-Flash-Next,后者被定位为Qwen4系列模型的技术雏形。Qwen3.8-Flash总参数量125B,含51B N-gram Embedding,每Token激活6B参数;原生支持26万Token上下文,经YaRN可扩展至100万Token。该模型训练成本为Qwen3.7-Plus的九分之一,API定价为每百万Token输入1元、输出3元,已上线千问AI平台,并推出“千问办公”功能。Flash-Next权重及技术报告已在Hugging Face和ModelScope公开。