苹果洽谈 PrismML,评估 iPhone 端侧运行大型 AI 模型压缩技术

据报道,苹果正与硅谷初创公司 PrismML 洽谈并评估其 AI 模型压缩技术,目标是将大型模型压缩至可在 iPhone 本地运行,以降低延迟和云计算成本,并增强端侧隐私保护能力。该进展或为 Siri 升级提供技术支持。PrismML 孵化于加州理工学院,获 Khosla Ventures 支持,已发布阿里巴巴开源模型 Qwen 的压缩版本,将约 54GB 模型压缩至不足 4GB,使 270 亿参数模型可在 iPhone 15 及更新机型上运行。

上一篇:

下一篇:

发表回复

登录后才能评论