OpenAI最新图像生成模型GPT Image2因卓越的生成与理解能力引发行业关注。项目核心团队仅13人,在4个月内完成底层架构重写,实现从“画得出”到“画得准”的跨越。研究负责人陈博远曾参与Gemini 2.0指令微调技术开发,并主导了模型训练与多语言图像渲染展示。中科大博士Jianfeng Wang负责的指令理解模块显著提高了模型在时间、空间布局等复杂场景下的准确性。浙大竺可桢学院的Yuguang Yang展示了模型将长篇论文自动转化为高精度PPT与信息图的功能。团队在多模态理解、混合专家模型(MoE)及长程引导等技术融合方面取得突破,推动AI绘图向通用智能绘制系统演进。