9月3日消息,AMD开源本地AI服务器Lemonade今日正式发布11.9版本,该版本最大的亮点是引入了实验性的ROCm HRX后端支持。
HRX是AMD ROCm生态中一项全新的低延迟、高性能计算栈,基于Loom编译器IR技术打造,旨在为AMD GPU/NPU/CPU提供统一的性能加速底座。

Lemonade是一款由AMD支持的免费开源本地AI服务器,支持Linux、Windows和macOS三大平台,可在本地硬件(CPU、GPU、NPU)上100%运行AI模型,数据无需上传云端。
ROCm在客户端AI领域长期被诟病“装死”,HRX后端的诞生正是源于AMD对ROCm在客户端系统部署痛点的回应。AMD工程师Stella Laurenzo此前坦言,ROCm最初面向数据中心开发,在客户端系统集成时常遇到阻力。
为此,AMD打造了HRX:一个轻量级、更聚焦的ROCm子集,为客户端使用场景专门优化。
性能方面,AMD表示HRX后端在Prefill阶段相比现有的Vulkan和HIP后端,可带来30%至50%的Token/s提升;在非MTP解码任务上,也可实现约10%的Token/s增益。
该后端目前已在AMD Radeon RX 7900系列RDNA3显卡和Strix Halo APU上完成初步验证。
值得一提的是,Lemonade 11.9版本是首次开放HRX对AMD GFX1100和GFX1151 GPU目标的支持。不过该功能目前仍处于实验阶段,GPU支持范围预计将在后续版本中快速扩展。
此外,新版本还带来了对Qwen3-Next模型的支持,并对Llama.cpp后端进行了多项改进。
对于AMD显卡用户和AI开发者而言,HRX意味着在不更换硬件的前提下,本地AI推理性能有望获得显著提升。

丁丁打折网©版权所有,未经许可严禁复制或镜像 ICP证: 湘ICP备2023003002号-11
Powered by 丁丁打折网本站为非营利性网站,本站内容均来自网络转载或网友提供,如有侵权或夸大不实请及时联系我们删除!本站不承担任何争议和法律责任!
技术支持:丁丁网 dddazhe@hotmail.com & 2010-2020 All
rights reserved