科技与AI

AMD锐龙AI Max+ PRO 495进入IFA 2026整机:128GB统一内存,四机可组集群

AMD锐龙AI Max+ PRO 495于IFA 2026随终端整机在柏林亮相

IFA 2026柏林展期间,AMD的锐龙AI Max+ PRO 495成了本地AI设备的核心部件。据界面新闻9月7日的现场报道,联想ThinkCentre X Ultra采用这颗处理器,最高配128GB统一内存,机身体积约1.6升,最多支持四台组成算力集群,用来跑更大的模型、更长的上下文窗口和多智能体流程。这颗芯片本身在今年5月发布,Engadget当时给出的规格是16核、5.2GHz加速频率、55 TOPS的NPU和Radeon 8065S核显;平台最高支持192GB统一内存,其中最多160GB可划给GPU当显存,锐龙AI Max 400系列的上市时间定在2026年第三季度。统一内存的意义在于CPU和GPU共用同一块内存池,模型权重不必在两者之间来回搬运;能塞进终端的模型有多大,因此主要由内存容量决定,不再受独立显卡显存的硬性上限约束。价格锚点来自上一代:AMD把搭载锐龙AI Max 300处理器的Halo整机定价3999美元,对标英伟达售价4699美元的DGX Spark,并按开发者每月云端token支出算了一笔半年回本的账;Max 400系列机型的售价当时尚未公布。

过去两年,AI算力叙事几乎全在数据中心和加速卡上。统一内存路线换了一个约束条件:决定终端能跑多大模型的不再是显卡显存,而是整机内存池。IFA上落地的是128GB配置的商用小型工作站,不是概念演示,说明端侧推理已经进了可采购的产品目录。对企业用户来说,数据不出本地、按整机一次性付费而不是按token计费,是与云端推理完全不同的一套成本结构。

对AMD,锐龙AI Max平台把x86的通用性和大内存池组合成了云端推理之外的一个选项,上一代Halo整机3999美元的定价明显冲着英伟达DGX Spark的4699美元去。对PC厂商,1.6升机身、四机可组集群的形态意味着AI工作站不必再做成塔式机器,商用渠道多了一条产品线。对云推理服务方,AMD公开算的那笔半年回本账,直指高频调用的开发者需求可能被本地设备截留。

后续关注

一看锐龙AI Max 400系列在2026年第三季度末的实际铺货节奏与整机定价,以及除了IFA上展出的128GB机型,有没有厂商真做出接近160GB显存分配上限的配置;二看多机集群何时从展台规格变成可交付方案;三看内存成本上行会不会把大内存池整机的价格优势磨掉。

信息来源

  1. Engadget媒体报道 · en · 2026年5月20日发布
  2. 界面新闻媒体报道 · zh · 2026年9月7日发布

GFT Finance 整理归纳公开信息并总结要点,不构成投资建议。数据以来源原文为准。