8月24日,AI评测机构 Artificial Analysis 与 Liquid AI 发布面向手机端本地AI的性能基准,测试模型在苹果 iPhone 17 Pro 上的表现。基准由 Artificial Analysis 负责智能测试、Liquid AI 负责推理性能,覆盖函数调用、指令遵循、知识认知、高难问答和数学。测试限定模型经4 bit量化后不超过8GB,并在16K上下文下运行。平均得分最高为南北阁 Nanbeige4.2-3B 与 Liquid AI LFM2.5-2.6B;若要求1分钟内响应,LFM2.5-8B-A1B 居首。