OpenAI内部测试的新模型Astra因在数学任务中表现突出引发关注。学者Gary Marcus指出,外界对该模型能力的解读可能存在夸大,数学领域适合符号验证,并可低成本生成大量合成数据,因此相关突破不一定可推广至开放式认知任务。由于OpenAI尚未披露Astra的方法细节和评估基准,业界对其真实能力仍缺乏充分判断。多位专家表示,数学能力提升并不等同于解决模型幻觉,也不意味着AGI即将实现。
OpenAI内部测试的新模型Astra因在数学任务中表现突出引发关注。学者Gary Marcus指出,外界对该模型能力的解读可能存在夸大,数学领域适合符号验证,并可低成本生成大量合成数据,因此相关突破不一定可推广至开放式认知任务。由于OpenAI尚未披露Astra的方法细节和评估基准,业界对其真实能力仍缺乏充分判断。多位专家表示,数学能力提升并不等同于解决模型幻觉,也不意味着AGI即将实现。