资讯
高通第六代骁龙8至尊版系列集成全新Hexagon NPU:专为AI智能体打造
📋总体概括
高通在第六代骁龙8至尊版系列中集成全新Hexagon NPU,专为终端侧AI智能体打造。新NPU引入Element Accelerator加速Transformer工作负载,并大幅扩展共享内存系统,将多模型状态、上下文与KV-cache数据贴近计算单元,缓解内存瓶颈。同时高通与内存及模型厂商合作引入MoE架构:300亿参数模型每次生成词元仅激活约30亿参数,大幅降低计算负载与内存带宽需求,推动智能体AI在手机端落地。
⚡关键信息
- ▸第六代骁龙8至尊版系列集成全新Hexagon NPU,定位为直接在终端侧运行AI智能体体验
- ▸新增Element Accelerator,结合向量与标量单元,加速大模型中最关键的Transformer运算
- ▸大幅扩展共享内存,让KV-cache等数据更靠近加速器,支持更长上下文与更多并发任务
- ▸携手内存和模型厂商引入MoE架构,300亿参数模型推理时每次仅激活约30亿被选中的参数
- ▸与每次推理需调用更大网络的密集模型相比,MoE按输入动态选择专家网络,显著降低计算与带宽压力
🔥犀利点评
端侧AI的真正瓶颈从来不是算力峰值,而是内存带宽和能效——高通这次盯的正是这两点,比堆TOPS实在得多。MoE稀疏激活是把大模型塞进手机的唯一现实路径,30亿对300亿的激活比就是卖点。但真功夫要看实测:上下文长度、并发智能体任务下的发热与续航,营销话术之外见真章。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →