❯ 初创PrismML把270亿参数模型塞进iPhone,苹果已接洽
发布要点AI 初创公司 PrismML 称已把一个 270 亿参数的大模型压缩到能在 iPhone 17 Pro 上本地流畅运行,刷新手机端 AI 模型规模纪录;据 MacRumors 报道,苹果已与其接洽,探讨这项技术的落地场景。被压缩的是阿里开源的 Qwen 3.6,体积从 54GB 砍到不足 4GB,压缩率超 90%。
细节背景关键在压缩的方式。据 MacRumors 报道,PrismML 声称在瘦身九成的同时,270 亿参数全部同时保持激活、基准性能不掉——这和苹果目前端侧模型走的”稀疏激活”路线正相反,用的是”全激活”,技术源自加州理工的专利。对苹果的吸引力很直接:它在端侧 AI 上一直有能力缺口,若能在本地跑起接近云端规模的模型,就能减少对谷歌云端算力的依赖。PrismML 迄今从 Khosla Ventures 等投资方拿了 1625 万美元,还放话未来要压缩万亿参数模型。不过这些性能说法目前只有公司单方面口径,尚待第三方验证。
影响落点对苹果的端侧 AI 策略,要重新掂量的是这条路径:如果 270 亿参数真能在 iPhone 上稳定跑,苹果那套”小模型上端、复杂任务甩给云”的分工就有改写空间,隐私和延迟都能往前挪一大步。对做端侧推理的芯片和软件团队,“全激活”若真成立,等于给手机塞进大模型提供了另一种技术范式。前提是这套压缩别只在演示机上好看——90% 压缩率不掉点的说法,得等独立测试站得住才算数。
signal: 把 270 亿参数塞进 iPhone 若被验证,苹果”小模型上端、大任务上云”的分工就有了改写的口子。