资讯

高通第六代骁龙8至尊版系列集成全新Hexagon NPU:专为AI智能体打造

驱动之家·2026/9/10 16:01:00🔗 原文

📋总体概括

高通在第六代骁龙8至尊版系列中集成全新Hexagon NPU,专为终端侧AI智能体打造。新NPU引入Element Accelerator加速Transformer工作负载,并大幅扩展共享内存系统,将多模型状态、上下文与KV-cache数据贴近计算单元,缓解内存瓶颈。同时高通与内存及模型厂商合作引入MoE架构:300亿参数模型每次生成词元仅激活约30亿参数,大幅降低计算负载与内存带宽需求,推动智能体AI在手机端落地。

关键信息

  • 第六代骁龙8至尊版系列集成全新Hexagon NPU,定位为直接在终端侧运行AI智能体体验
  • 新增Element Accelerator,结合向量与标量单元,加速大模型中最关键的Transformer运算
  • 大幅扩展共享内存,让KV-cache等数据更靠近加速器,支持更长上下文与更多并发任务
  • 携手内存和模型厂商引入MoE架构,300亿参数模型推理时每次仅激活约30亿被选中的参数
  • 与每次推理需调用更大网络的密集模型相比,MoE按输入动态选择专家网络,显著降低计算与带宽压力

🔥犀利点评

端侧AI的真正瓶颈从来不是算力峰值,而是内存带宽和能效——高通这次盯的正是这两点,比堆TOPS实在得多。MoE稀疏激活是把大模型塞进手机的唯一现实路径,30亿对300亿的激活比就是卖点。但真功夫要看实测:上下文长度、并发智能体任务下的发热与续航,营销话术之外见真章。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文