资讯

迷你主机跑300B大模型!极摩客EVO-X5 Pro发布:锐龙AI Max+ PRO 495+192GB内存

驱动之家·2026/9/11 03:29:00🔗 原文

📋总体概括

极摩客在IFA 2026发布EVO-X5 Pro迷你主机,搭载AMD锐龙AI Max+ PRO 495(Zen 5架构16核32线程,加速5.2GHz)与192GB LPDDR5X-8533统一内存,带宽273GB/s,最高160GB可动态分配为显存。集成40CU Radeon 8065S核显与55 TOPS NPU,整机算力131 TOPS。按4-bit量化,300B参数模型纯权重约150GB,接近显存上限,宣称可本地运行300B级大模型,但上下文长度受剩余空间制约。

关键信息

  • 极摩客在IFA 2026展出EVO-X5 Pro迷你主机,搭载AMD锐龙AI Max+ PRO 495与192GB LPDDR5X-8533内存
  • 处理器为Zen 5架构16核32线程,加速5.2GHz,集成40CU RDNA 3.5核显与XDNA 2架构NPU(55 TOPS),整机算力131 TOPS
  • 192GB统一内存带宽273GB/s,最高160GB可动态分配为显存,CPU与GPU共享物理内存免数据搬运
  • 300B模型按4-bit量化纯权重约150GB,逼近160GB显存上限,KV缓存与量化附加数据需额外空间
  • 能否跑满上下文长度取决于具体模型架构,官方宣称的300B本地运行存在条件限制

🔥犀利点评

把300B塞进迷你主机确实是PC史上头一回,AMD统一内存路线的杀伤力正在兑现——不用买H100,一台盒子就能本地推理千亿模型。但别急着欢呼:273GB/s的带宽跑150GB权重的生成速度注定感人,token输出大概率慢到只适合离线批处理而非对话。160GB上限卡掉KV缓存空间,长上下文基本没戏。这是极客玩具和边缘推理方案,不是ChatGPT替代品,营销话术里的「能跑」和「好用」之间隔着一个数量级。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文