高通近日在官方平台正式推出新一代Hexagon神经网络处理器(NPU),这款专为下一代AI智能体设计的芯片已集成于第六代骁龙8至尊版系列移动平台。该处理器通过架构创新与内存系统升级,在移动端AI性能与能效领域实现突破性进展。
核心升级聚焦于两大技术模块:全新设计的Element Accelerator单元与扩展型共享内存系统。前者针对生成式AI和智能体AI的Transformer架构优化,通过向量与标量计算单元的深度协同,显著提升大语言模型推理过程中的矩阵运算效率。这项改进使智能体在复杂任务中的响应速度提升30%,同时保持移动设备特有的低功耗特性。
内存系统的革新成为另一关键突破。高通将共享内存容量扩大至原有架构的2.5倍,使多模型并行处理时的状态数据、上下文信息及KV缓存能够更靠近计算核心。这种设计有效缓解了传统架构中的内存带宽瓶颈,特别在处理长文本生成任务时,系统延迟降低达45%。
在生态合作层面,高通正联合内存供应商与模型开发商推进混合专家模型(MoE)的移动端部署。以300亿参数规模的MoE模型为例,其独特的参数路由机制可在每次生成词元时仅激活约10%的精选参数,既保持了超大模型的处理能力,又将功耗控制在传统架构的60%水平。这种创新架构为移动设备运行百亿级参数模型提供了可行路径。
