发布于2026-08-14 阅读(0)
扫一扫,手机访问
昨天(7月9日),科技媒体 The Information 放出一条消息:苹果正在接触一家名为 PrismML 的初创公司,核心目的很明确——评估在 iPhone 上直接运行更大规模 AI 模型的可行性。
这家 PrismML 来头不小,是加州理工学院的衍生公司。它的看家本领是一种原生 1-bit 模型压缩技术,能把模型体积压缩到全精度版本的 1/14 左右,内存占用直接降低超过 90%。
具体来说,这种技术里权重只用了 {-1, +1} 两个值,配合分组缩放因子来调整精度。注意,这不是传统的量化,官方声称没有“高精度逃生通道”,也就是说不是靠保留部分高精度位来凑数。更关键的是,它宣称能在保持接近 FP16 模型精度的同时,把推理速度提升最高 8 倍,能耗则降低 75%-80%。

有意思的是,PrismML 已经成功将阿里巴巴开源的 Qwen 3.6 模型(27B 参数)精简压缩,并在 iPhone 17 Pro 上完整跑了起来。苹果看中的正是这种量化能力——如果能落地,本地 AI 的推理性能将再上一个台阶。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9