苹果洽谈AI模型压缩技术,大模型或可在手机端运行
来源:龙灵发布时间:2026-07-15257浏览
询问 AI据媒体报道,苹果公司正与硅谷初创企业PrismML展开初步接触,探讨将大型人工智能模型压缩并在iPhone端本地运行的可行性。PrismML首席执行官透露,苹果已开始评估其相关技术,目前双方洽谈进展顺利。
PrismML由加州理工学院研究团队孵化,并获得Khosla Ventures的投资支持。该公司近期发布了阿里巴巴开源模型Qwen的压缩版本,将约54GB的原始模型缩减至4GB以内,使270亿参数的模型能够直接在iPhone 15及更新机型上运行。目前,该企业已免费开放两个兼容iPhone、MacBook及搭载英伟达芯片个人电脑的压缩版本,后续计划对谷歌开源模型Gemma及更大规模的前沿模型进行压缩处理。
将更多人工智能计算保留在设备本地,有助于降低响应延迟与云计算成本,并支持部分功能的离线使用。这不仅契合苹果注重隐私保护的定位,也能为Siri的升级提供关键技术支撑。Counterpoint分析师Pathak指出,结合云端与设备端的人工智能技术,能够构建更高效且注重隐私的体验,复杂任务交由云端处理,对延迟和隐私要求较高的任务则在设备端执行。
此外,PrismML的压缩方案可将原本需要8块GPU运行的云端模型缩减至1块,并实现服务器模型向终端设备的迁移。不过,这虽然降低了单一人智能任务对内存或算力的要求,但并不意味着整体芯片需求会随之下降。
新闻来源:龙灵,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。
