很多朋友不知道【稳定运行!第六代骁龙8超级至尊版演示全链路自主办公】,今天小绿就为大家解答一下。

版权所有,未经许可不得转载

阶跃副总裁、端侧模型负责人俞刚表示,阶跃30B-MoE模型是目前市面上最大的手机端侧模型,也是首个在第六代骁龙8超级至尊版移动平台上完成跑通和验证的MoE模型。 高通技术公司高级副总裁兼手机业务总经理Chris Patrick表示:“此次合作展现了硬件、软件、内存和AI模型等多个领域的技术进步,如何推动日益复杂的AI工作负载直接在移动终端上运行。通过与阶跃、无量火和江波龙合作,我们优化了阶跃30B-MoE模型在第六代骁龙8超级至尊版移动平台上的部署,在提升吞吐性能、降低内存需求的同时,实现了持续稳定的终端侧运行。” 得益于此,该端侧智能体助手实现了从邮件理解到行程规划、日历同步、航班酒店推荐、行程分享到邮件草拟的全链路自主办公,全程本地完成,无需云端调用。得益于NPU+GPU双引擎协同,模型预填充吞吐性能超过330 Token/s,对比仅使用NPU的通用推理方案提升超过30%,解码吞吐性能超过28 Token/s,并能保持持续稳定运行,且首个词元生成速率达到毫秒级,对比云端API调用快数倍至数十倍。 在此之上,无量火的自研Ember推理引擎与Ember Kernel端侧编排内核基于第六代骁龙8超级至尊版移动平台的AI性能基础和完整软件栈支持,以XCompute异构调度实现跨CPU/GPU/NPU的统一高性能编排,在不修改模型结构、不损失推理精度的前提下,使阶跃30B-MoE模型的运行内存需求相比行业常规方案降低超50%。基于江波龙提供的端侧AI存储解决方案,模型权重可从端侧闪存高效加载,通过存储与计算协同减少大模型对运行内存的持续占用,进一步提升模型加载和运行效率。 此次合作解决了大参数模型在端侧部署的关键行业痛点,让300亿参数量级模型具备在智能手机上规模部署的条件,将推动更加复杂的智能体AI体验落地智能手机,并利用端侧用户数据和平台能力实现更加个性化的智能体服务。与每次推理均需激活全部参数的Dense模型相比,MoE模型仅按任务需要激活部分专家模块,在保持大模型容量与能力的同时,显著降低计算量和内存带宽需求,日益成为推动云端规模大模型向终端侧部署的重要技术路径之一。 江波龙副总裁、嵌入式存储事业部总经理黄强表示,江波龙将行业独有的iSA存储智能体率先适配第六代骁龙8超级至尊版移动平台,通过存算协同释放平台算力价值。
第六代骁龙8超级至尊版
【CNMO科技消息】9月23日,在2026骁龙峰会期间,高通技术公司宣布携手阶跃、无量火与江波龙开展四方合作,基于第六代骁龙8超级至尊版移动平台,将阶跃StepEdge-Omni 30B-MoE(混合专家)模型面向端侧进行深度适配与推理优化,成功打造具备自主服务和个性化能力的端侧智能体助手,并在峰会现场完成基于高通参考设计的现场演示,验证了复杂智能体AI工作流在智能手机上的高效部署与规模化扩展能力。 无量火CEO王瑜琨表示,Ember推理引擎将大模型内存需求降低超过50%,让手机即可流畅运行30B大型MoE模型。
第六代骁龙8超级至尊版与第六代骁龙8至尊版
第六代骁龙8超级至尊版移动平台搭载全新Qualcomm Oryon CPU、下一代Qualcomm Adreno GPU和重新设计的Qualcomm Hexagon NPU,并配备LPDDR6内存与高速存储通道。定制Qualcomm Oryon CPU峰值频率高达5GHz,并引入全新的可扩展缓存架构Qualcomm Oryon FlexCache;Adreno GPU引入针对AI负载打造的Adreno Matrix Cores,并支持全新Adreno Neural Fusion特性;Hexagon NPU面向智能体AI的Transformer工作负载引入全新的Element Accelerator,并将大容量共享内存扩容50%。
以上问题已经回答了。如果你想了解更多,请关
新经网网站 (
https://www.xinhuatone.com/)