资讯
【明日主题前瞻】DeepSeek V4.1 Flash发布:具备原生多模态视觉理解能力
📋总体概括
DeepSeek发布V4.1 Flash模型,为其全新模型结构系列中最小尺寸产品,首次具备原生多模态视觉理解能力。技术核心是大幅压缩KV Cache缓存,使HBM需求降至上一代的1/4、SSD需求降至1/8,显著降低Agent类任务的推理成本。券商认为国产大模型智能与商业化能力持续强化,模型降价将打开下游AI应用落地空间,算力、AI应用等产业链方向值得关注。
⚡关键信息
- ▸DeepSeek发布V4.1 Flash,是全新模型结构系列中最小尺寸模型,具备原生多模态视觉理解能力
- ▸KV Cache压缩使HBM需求降至上一代的1/4,SSD需求降至1/8
- ▸Agent场景中缓存命中费用占比较高,KV Cache压缩大幅降低Agent任务使用成本
- ▸券商认为国产开源模型商业化能力强化,或推动模型降价,扩大下游AI应用落地空间
🔥犀利点评
这次发布真正的看点不是多模态,而是用架构革新把HBM需求砍到1/4——DeepSeek又一次用软件优化对冲硬件成本,等于变相发起价格战。受益逻辑上,推理成本暴跌利好AI应用放量,但对堆芯片卖算力的厂商未必是好消息。券商的『应用落地』叙事年年讲,这次至少有了成本端的硬支撑。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 财联社深度 阅读全文 →