高通骁龙峰会展示端侧30B-MoE模型完成邮件理解、行程规划等连续任务,标志端侧AI从单次问答迈向智能体工作流。
高通联合阶跃等厂商在第六代骁龙8平台上端侧适配300亿参数MoE模型,内存需求降超50%,预填充吞吐超330 Token/s。
以下为与“MoE模型”相关的文章,共 2 篇