发布于2026-08-02 阅读(0)
扫一扫,手机访问
7月15日,一则消息在科技圈悄然传开:苹果正在与硅谷一家名为PrismML的初创公司进行早期接触,评估其AI模型压缩技术能否应用于iPhone。如果这条路走得通,我们很快就能在手机上本地运行一个拥有270亿参数的大模型——这可不是什么缩水版,而是实打实的“巨无霸”AI。对于苹果而言,这不仅是隐私战略的一次关键升级,更可能让正在经历重大改版的Siri,真正具备与OpenAI、Anthropic等对手正面硬刚的底气。
这个时间点很微妙。iOS 27公测版刚刚大幅更新了Siri的界面和交互逻辑,显然苹果正在全力备战AI助手的新一轮竞争。而PrismML的CEO也透露,双方评估已经启动,虽然还在早期阶段,但“进展顺利”——这句话背后的信息量,值得细品。
PrismML的技术底子来自加州理工学院的一个数学突破,投资方是Khosla Ventures。这家公司近期做了一件让人眼前一亮的事:它把阿里巴巴开源的Qwen模型进行了压缩,本来约54GB的模型,愣是被塞进了不到4GB的空间里。这意味着,一个270亿参数的大模型,可以在iPhone 15及之后的机型上直接运行。更具体地说,这套压缩方案能让内存占用降低10到15倍,响应速度提升6到8倍,能耗则下降3到6倍。数据摆在这里,技术指标的跃升是实打实的。
对苹果来说,把更多AI运算留在设备本地,战略价值怎么强调都不为过。延迟更低、云成本更少、还能在无网络环境下使用部分AI功能——这三点加起来,恰好完美契合苹果一直强调的隐私定位。Counterpoint的分析师Pathak评价得很到位:云端与设备端的AI组合,才是那个既能打、又高效、还尊重用户隐私的完整方案。
不过,技术指标再亮眼,也绕不开一个现实问题:它到底能不能扛住大规模的真实使用?IDC负责客户端处理器研究的Phil Solis就点出了一个关键点——即便是内存占用降低了,一个被频繁调用的强大模型,对手机电池的消耗依然不可小觑。功耗和可靠性,才是接下来真正的试金石。
更值得关注的是,PrismML的技术突破,正在引发市场对AI芯片需求的重新思考。它能让原本需要8块GPU才能运行的云端模型,缩减到只需1块——这听起来像是芯片需求要萎缩了。但D.A. Da vidson分析师Gil Luria的视角更犀利:模型瘦身并不会消除对处理器或内存的需求,它只是把算力需求从数据中心转移到了手机等终端设备上。效率的突破,往往会催生更多的使用场景,而不是带来预算的缩减。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9