ROCm终于不装死了!Lemonade 11.9发布:新后端让AMD显卡性能提升30%
📋总体概括
快科技9月3日消息,AMD开源本地AI服务器Lemonade今日正式发布11.9版本,该版本最大的亮点是引入了实验性的ROCm HRX后端支持。 HRX是AMD ROCm生态中一项全新的低延迟、高性能计算栈,基于Loom编译器IR技术打造,旨在为AMD GPU/NPU/CPU提供统一的性能加速底座。 Lemonade是一款由AMD支持的免费开源本地AI服务器,支持Linux、Windo
⚡关键信息
- ▸快科技9月3日消息,AMD开源本地AI服务器Lemonade今日正式发布11.9版本,该版本最大的亮点是引入了实验性的R
- ▸HRX是AMD ROCm生态中一项全新的低延迟、高性能计算栈,基于Loom编译器IR技术打造,旨在为AMD GPU/NP
- ▸Lemonade是一款由AMD支持的免费开源本地AI服务器,支持Linux、Windows和macOS三大平台,可在本地
快科技9月3日消息,AMD开源本地AI服务器Lemonade今日正式发布11.9版本,该版本最大的亮点是引入了实验性的ROCm HRX后端支持。
HRX是AMD ROCm生态中一项全新的低延迟、高性能计算栈,基于Loom编译器IR技术打造,旨在为AMD GPU/NPU/CPU提供统一的性能加速底座。
Lemonade是一款由AMD支持的免费开源本地AI服务器,支持Linux、Windows和macOS三大平台,可在本地硬件(CPU、GPU、NPU)上100%运行AI模型,数据无需上传云端。
HRX后端的诞生源于AMD对ROCm在客户端系统部署痛点的回应。AMD工程师Stella Laurenzo在GGML社区讨论中坦言,ROCm最初面向数据中心开发,在客户端系统集成时常遇到阻力。
为此,AMD打造了HRX:一个轻量级、更聚焦的ROCm子集,为客户端使用场景专门优化。
性能方面,AMD表示HRX后端在Prefill阶段相比现有的Vulkan和HIP后端,可带来30%至50%的Token/s提升;在非MTP解码任务上,也可实现约10%的Token/s增益。
该后端目前已在AMD Radeon RX 7900系列RDNA3显卡和Strix Halo APU上完成初步验证。
值得一提的是,Lemonade 11.9版本是首次开放HRX对AMD GFX1100和GFX1151 GPU目标的支持。不过该功能目前仍处于实验阶段,GPU支持范围预计将在后续版本中快速扩展。
此外,新版本还带来了对Qwen3-Next模型的支持,并对Llama.cpp后端进行了多项改进。
对于AMD显卡用户和AI开发者而言,HRX意味着在不更换硬件的前提下,本地AI推理性能有望获得显著提升。

