AMD推出可本地运行万亿参数AI的工作站
在2026年IFA展会上,AMD发布了Threadripper Halo Station工作站,配备96核处理器与两至四块Instinct MI350P加速卡,据该公司介绍,它可在本地运行参数量超过一万亿的AI模型。

在2026年IFA展会上,AMD发布了Threadripper Halo Station工作站,该公司将其描述为把数据中心级算力装进一台桌面塔式主机。据法国ZDNet报道,其目标是在本地运行参数量超过一万亿的AI模型——这一规模此前只有云端服务器集群才能承载。
塞进桌面塔机的服务器级处理器
这台机器的核心是基于Zen 5架构的AMD锐龙Threadripper PRO 9995WX处理器:96核心、192线程,加速频率最高达5.4GHz,配备384MB三级缓存,热设计功耗为350W,据Tom's Hardware报道。它最多可搭配2TB八通道DDR5内存,这是该芯片支持的最大配置。
AI加速任务由2026年5月发布的AMD Instinct MI350P GPU承担,采用第四代CDNA架构,基于台积电3纳米工艺制造。每块加速卡配备144GB HBM3E显存,通过PCIe 5.0连接。参考配置搭载两块加速卡,共288GB显存;AMD表示系统最多可扩展至四块加速卡,届时总显存将提升至576GB。
- 处理器:AMD Threadripper PRO 9995WX,96核/192线程,最高5.4GHz
- 加速卡:2至4块AMD Instinct MI350P GPU(CDNA 4),每块144GB HBM3E
- 系统内存:最高2TB DDR5
- 总内存:最高2.6TB,聚合带宽最高16.4TB/s
- 功耗:处理器350W,每块加速卡600W,双卡参考配置总功耗约1550W
- 全液冷散热,覆盖处理器与GPU
为何要在本地运行AI而非依赖云端
ZDNet指出,AMD选择桌面主机而非远程服务器,是在回应研究人员和开发者的一个非常现实的问题:运行最庞大的AI模型时,云端推理费用不断攀升。运行一个万亿参数模型通常需要多块按小时租用的数据中心GPU;Threadripper Halo Station则提出一次性拥有这份算力,不再受制于云服务商的可用性与定价。
ZDNet援引AMD官网的说法称,这款机器尤其面向受限于云端访问权限或共享基础设施的团队,以及那些必须将敏感数据保留在内部的团队。这正是本地部署的另一个优势所在:数据保密。在企业自有场地内运行的模型不会向第三方传输任何数据,这对制药研究、国防和金融服务领域而言至关重要。
AMD在本地AI领域对抗Nvidia
据Tom's Hardware报道,从技术上看,Threadripper Halo Station本质上是一个被改装成塔式机箱的服务器托盘:原本为数据中心EPYC芯片设计的机箱,被AMD换成了Threadripper处理器。这场竞争的焦点并非纯粹的算力——在这方面Nvidia凭借Blackwell芯片依然占优——而是板载显存容量,正是它决定了一台机器一次能加载多大的模型。通过堆叠最多576GB的HBM3E加上2TB的DDR5,AMD意图超越搭载Nvidia GPU的竞品工作站。
全球最强大的AI工作站,能够运行万亿参数模型。
这样的配置也意味着高昂的价格:Tom's Hardware估计,仅核心组件(处理器、内存、两块加速卡)的市场价就超过10万美元,加上存储、电源和散热系统后可能超过15万美元——这一价位与联想ThinkStation P8相当,后者搭载Threadripper Pro处理器和Nvidia Blackwell GPU,满配售价为334463美元。AMD尚未公布Threadripper Halo Station的官方售价,也未指定负责生产的OEM合作伙伴:据ZDNet报道,该产品计划自2027年起通过主要PC厂商推向市场。
这对希望本地部署AI的企业意味着什么
对于希望部署生成式AI、又不愿让数据流经境外云平台的企业而言——出于数据合规与数字主权方面的考量,这类顾虑正在增加——这种级别的机器提供了一条切实可行的路径:在自有场所内训练或运行大模型,用固定的基础设施成本取代随使用量增长的推理账单。不过,Threadripper Halo Station目前仍只是一款参考设计,尚无确定的售价与上市时间,其宣布的入门价格——满配可达数十万美元——目前更适合大型实验室、专业IT集成商或预算充足的研发部门,而非普通中小企业。



