阿里正式发布新一代图像生成基础模型Qwen-Image-3.0。该模型支持最高4.5K Token文本输入,较上一代提升4.5倍,可一次生成包含公式、几何图形、逻辑推导、多层UI等复杂图文内容,并支持12种语言和20余款字体渲染。官方称,模型强化语义解析、空间布局和小字号文字呈现能力,适用于影视分镜、知识图解、产品说明页、人像摄影、数学试卷、直播页面等场景,面向商业级内容生成进行了优化。
阿里正式发布新一代图像生成基础模型Qwen-Image-3.0。该模型支持最高4.5K Token文本输入,较上一代提升4.5倍,可一次生成包含公式、几何图形、逻辑推导、多层UI等复杂图文内容,并支持12种语言和20余款字体渲染。官方称,模型强化语义解析、空间布局和小字号文字呈现能力,适用于影视分镜、知识图解、产品说明页、人像摄影、数学试卷、直播页面等场景,面向商业级内容生成进行了优化。