OpenAI Codex负责人Tibo宣布,GPT-5.3-Codex-Spark将于下周退役。该模型于2月12日发布,支持128K上下文,生成速度超过每秒1000个Token,底层采用Cerebras WSE-3芯片,是OpenAI首个面向实时编程、脱离英伟达技术栈运行的生产模型。OpenAI表示,Spark使用量持续下降,且已有性能更好的模型。评测显示,其Terminal-Bench 2.0得分为58.4%,低于GPT-5.3-Codex的77.3%。8月13日,Cerebras推出基于旗舰模型的Ultrafast模式,速度最高达每秒750个Token,相关能力由独立模型转向旗舰模型的速度档位。