过去一年,AI编程和办公工具在PC端快速普及,但手机AI仍以单次问答为主。2026年骁龙峰会上,高通联合阶跃星辰等厂商演示了典型案例:端侧30B-MoE模型完全在本地完成读懂邮件、提取行程、同步日历、推荐航班酒店并草拟回复的完整工作链,标志着端侧AI从单次调用迈向连续任务执行。
高通今年发布第六代骁龙8至尊版与超级至尊版双旗舰,均采用2nm工艺。芯片内部重新分配计算资源:CPU负责任务调度,NPU承担模型推理,低功耗感知单元处理后台信息。新双Micro NPU架构性能提升85%、功耗降低20%,让手机能常驻智能体而不持续发烫耗电。复杂任务仍可调用云端,端侧则承担低时延、离线可用的高价值部分。
生态层面,高通推出START计划降低AR眼镜等新硬件的集成门槛,Adreno Neural Fusion则用AI增强移动游戏渲染。但高通中国区董事长孟樸对36氪坦言,跨终端持续服务的个人智能体可能要到2027至2028年才会稳定落地。
竞争压力同样在扩大。联发科天玑9600系列同样采用2nm并支持30B-MoE端侧运行;小米、苹果等客户也在自研芯片。模型每3个月迭代一次,远快于手机9至12个月的适配周期。高通下一轮胜负不只取决于能装进多大的模型,更取决于能否让快速变化的模型及时变成用户愿意反复使用的产品。
