据The Information报道,苹果正接洽加州理工学院衍生AI初创公司PrismML,评估其1-bit模型压缩技术在iPhone端侧运行大模型的可行性。PrismML称,该技术以正负1表示权重,可将模型体积压缩至全精度约1/14,内存占用降低超90%,推理速度最高提升8倍,能耗降低75%至80%。公司已将阿里开源27B参数模型Qwen 3.6压缩后在iPhone 17 Pro上完整运行,且保持接近FP16模型精度。
据The Information报道,苹果正接洽加州理工学院衍生AI初创公司PrismML,评估其1-bit模型压缩技术在iPhone端侧运行大模型的可行性。PrismML称,该技术以正负1表示权重,可将模型体积压缩至全精度约1/14,内存占用降低超90%,推理速度最高提升8倍,能耗降低75%至80%。公司已将阿里开源27B参数模型Qwen 3.6压缩后在iPhone 17 Pro上完整运行,且保持接近FP16模型精度。