产业观察

国产AI开始自我优化国产芯片:GLM-5.3 Flash两周实现3.2倍性能

驱动之家·2026/9/17 11:18:00🔗 原文

📋总体概括

智谱宣布其多模态大模型GLM-5.3 Flash首次实现全国产芯片部署,使用10万块国产AI芯片,单位Token推理成本较年初下降80%。更关键的是,由GLM-5.3驱动的Infra Agent在两周内自主完成国产加速卡适配,修复KDA精度漂移、将KV传输开销从30%以上降至1%以内、重构Decode算子获得1.71倍加速,端到端吞吐提升至3.2倍。创始人唐杰称这是RSI自我递归能力的早期迹象,即AI开始自我优化部署自身的国产算力基础设施。

关键信息

  • GLM-5.3 Flash首次采用全国产芯片部署,规模达10万块国产AI芯片
  • 单位Token推理成本较年初下降80%,国产算力经济性显著改善
  • GLM-5.3驱动的Infra Agent两周内自主跑通国产加速卡并承载全部线上流量
  • 端到端吞吐提升至3.2倍,其中KV传输开销从30%以上降至1%以内
  • Decode算子重构带来1.71倍加速,KDA精度漂移问题被自主修复

🔥犀利点评

这才是国产芯片被卡脖子之后最正确的打开方式:不是硬堆人肉适配,而是让AI自己学会用国产硬件。两周跑通全量流量、KV开销从30%压到1%,说明国产卡的问题很大程度在软件栈而非硬件本身,AI驱动的Infra Agent恰好补上这块短板。当然,「RSI早期迹象」的说法营销味偏浓,本质还是编译器优化式的自动化调优,别急着造神。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文