资讯

ROCm终于不装死了!Lemonade 11.9发布:新后端让AMD显卡性能提升30%

驱动之家·2026/9/3 03:19:00🔗 原文

📋总体概括

AMD开源本地AI服务器Lemonade发布11.9版本,引入实验性ROCm HRX后端。HRX是基于Loom编译器IR技术的低性能计算栈,为GPU/NPU/CPU提供统一加速底座,定位为轻量级ROCm子集,专门优化客户端场景。官方称其在Prefill阶段相比现有Vulkan和HIP后端可带来30%-50%的Token/s提升。此举直指ROCm长期面向数据中心开发、在客户端系统部署困难、被用户吐槽「装死」的痛点,是AMD补齐客户端AI软件生态短板的关键一步。

关键信息

  • Lemonade 11.9发布,引入实验性ROCm HRX后端,AMD开源本地AI服务器支持Linux/Windows/macOS三平台
  • HRX基于Loom编译器IR技术打造,定位轻量级ROCm子集,为GPU/NPU/CPU提供统一加速底座
  • 官方数据:Prefill阶段相比Vulkan和HIP后端提升30%-50%的Token/s
  • AMD工程师Stella Laurenzo承认ROCm最初面向数据中心开发,客户端系统集成长期存在阻力
  • HRX是AMD直接回应ROCm客户端部署痛点、补齐消费级AI软件栈短板的动作

🔥犀利点评

AMD终于承认了ROCm在客户端就是个半成品。数据中心基因的软件栈硬塞给消费级用户,装不上、跑不快,逼得AMD另起炉灶搞HRX这个轻量子集。30%-50%的提升听着漂亮,但这是官方自测、还是实验性阶段、还是只优化了Prefill,水分要自己挤。真正的问题在于:HIP、Vulkan、ROCm、HRX四条技术路线并存,AMD软件栈碎片化到让开发者无所适从。能不能收敛路线、持续迭代,比单点性能数字重要得多。

快科技9月3日消息,AMD开源本地AI服务器Lemonade今日正式发布11.9版本,该版本最大的亮点是引入了实验性的ROCm HRX后端支持。

HRX是AMD ROCm生态中一项全新的低延迟、高性能计算栈,基于Loom编译器IR技术打造,旨在为AMD GPU/NPU/CPU提供统一的性能加速底座。

 ROCm终于不装死了!Lemonade 11.9发布:新后端让AMD显卡性能提升30%

Lemonade是一款由AMD支持的免费开源本地AI服务器,支持Linux、Windows和macOS三大平台,可在本地硬件(CPU、GPU、NPU)上100%运行AI模型,数据无需上传云端。

ROCm在客户端AI领域长期被诟病“装死”,HRX后端的诞生正是源于AMD对ROCm在客户端系统部署痛点的回应。AMD工程师Stella Laurenzo此前坦言,ROCm最初面向数据中心开发,在客户端系统集成时常遇到阻力。

为此,AMD打造了HRX:一个轻量级、更聚焦的ROCm子集,为客户端使用场景专门优化。

性能方面,AMD表示HRX后端在Prefill阶段相比现有的Vulkan和HIP后端,可带来30%至50%的Token/s提升;在非MTP解码任务上,也可实现约10%的Token/s增益。

该后端目前已在AMD Radeon RX 7900系列RDNA3显卡和Strix Halo APU上完成初步验证。

值得一提的是,Lemonade 11.9版本是首次开放HRX对AMD GFX1100和GFX1151 GPU目标的支持。不过该功能目前仍处于实验阶段,GPU支持范围预计将在后续版本中快速扩展。

此外,新版本还带来了对Qwen3-Next模型的支持,并对Llama.cpp后端进行了多项改进。

对于AMD显卡用户和AI开发者而言,HRX意味着在不更换硬件的前提下,本地AI推理性能有望获得显著提升。

 ROCm终于不装死了!Lemonade 11.9发布:新后端让AMD显卡性能提升30%

本文由本站自动聚合,以下为原始来源:原文 驱动之家 快讯 →