站长之家 - 业界 2026-07-15 09:02

苹果研发AI模型压缩技术:把270亿参数大模型装进iPhone

据媒体报道,苹果公司正在与硅谷初创企业PrismML进行初步接洽,后者宣称能够将大规模机器学习模型压缩至可在iPhone上本地运行的程度。若该项技术通过验证,将强化苹果的隐私承诺,并为其进展缓慢的Siri升级提供关键支撑。

PrismML首席执行官透露,苹果已着手评估其技术。“洽谈仍处在早期阶段,前景尚不明朗,但进展顺利。”

这一消息正值苹果推出iOS 27公测版的次日,这也是Siri经历大幅改版后首次面向公众的广泛测试,旨在与OpenAI和Anthropic开发的智能助手展开竞争。

对苹果而言,将更多模型运算保留在设备端,意味着更低的响应延迟、更少的云端计算开销,以及部分功能无需联网即可使用的能力,这与其核心隐私定位高度契合。

PrismML的公开发布,为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint分析师Pathak总结称:“云端与设备端智能模型的组合,能够提供更完整、更高效、更注重隐私的体验。复杂任务交由云端处理,而敏感、时延敏感及隐私相关的任务则在设备端执行。”

PrismML孵化自加州理工学院的研究团队,并获得Khosla Ventures的支持。该公司于周二公开发布了阿里巴巴开源模型Qwen的压缩版,将原始模型从约54GB压缩至不足4GB,使其全部270亿参数能够在iPhone 15及更新机型上直接运行。

目前,PrismML已免费发布两个压缩版本,兼容iPhone、MacBook以及搭载英伟达芯片的个人电脑。公司表示,下一个压缩目标是谷歌的开源模型Gemma,随后还将着手处理那些需要数据中心硬件才能运行的更大规模前沿模型。

PrismML指出,其压缩方案可将原本需要8块GPU运行的云端模型缩减至仅需1块,并让原本依赖服务器的模型迁移至手机和笔记本电脑。此举虽能降低单次任务对内存或算力的需求,但并不必然导致整体芯片需求下降。

推荐关键词

24小时热搜

查看更多内容

大家正在看