苹果接洽PrismML研发AI压缩技术 实现iPhone本地运行大模型

2026年7月,苹果正与硅谷初创公司PrismML开展早期接洽,共同研发AI模型压缩技术,目标是实现高参数大模型在iPhone端本地运行,支撑刚开启公测的iOS27内置改版Siri性能提升,强化隐私保护核心优势,与OpenAI、Anthropic旗下AI助手展开市场竞争,目前苹果已启动该技术可行性评估工作。

配图

本次接洽消息曝光的时间,恰好是苹果推出iOS27公测版的次日。这一版本中,苹果对服役十余年的Siri进行了有史以来最大幅度的改版,首次接入大语言模型能力,意图扭转其在智能助手赛道落后于ChatGPT、Claude的市场口碑。

但此前受限于端侧算力,改版Siri的高阶功能全部依赖云端响应,不仅存在响应延迟高、无网络不可用的问题,也不符合苹果长期奉行的用户数据本地处理的隐私原则,这也成为苹果加速推进模型压缩技术落地的核心动因。

PrismML是硅谷专注于AI模型轻量化的初创公司,其核心技术可在尽可能降低推理精度损失的前提下,将大模型的体积压缩至原有的十分之一甚至更低。苹果本次与其合作的核心目标,就是将原本只能在数据中心GPU集群上运行的千亿参数大模型,压缩到适配iPhone A系列仿生芯片的运行规格。

如果该技术落地,用户使用Siri的响应延迟将降低70%以上,且无需将交互数据上传至云端,既可以节省苹果每年数亿美元的云计算成本,也能进一步放大其在隐私保护领域的竞争优势,甚至可实现无网络环境下正常使用大模型相关功能。目前苹果内部已经启动对PrismML技术方案的可行性验证,双方洽谈进展顺利。

尽管技术方向已经明确,但端侧大模型的大规模落地仍有不少问题待解。首先是模型压缩的精度损失问题,如何在压缩体积的同时保留大模型的复杂推理、多模态理解能力,仍是行业尚未完全攻克的难题;其次是功耗控制,持续运行大模型将对iPhone的电池续航带来不小的挑战,需要芯片、系统调度等多环节的协同优化。

据行业人士预测,如果本次技术验证顺利,苹果最早会在2027年发布的iPhone 16系列上标配本地大模型功能,该功能也将同步适配iPad、Mac等其他苹果硬件产品。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。