同一场大会的两条产品线

9 月 21 日,2026 人工智能计算大会(AICC 2026)在北京中关村国际创新中心举行,浪潮信息在会上发布两款产品:元脑 SD200 Ultra 超节点 AI 服务器与元脑 HC2000 多元算力机组。前者面向智能上限,后者面向供给效率。需要说明的是,浪潮信息上一次进入公众视野,是作为 IDC 计算力报告的合作方被覆盖;本次是其自身的产品发布,属同主体的另一条独立事件线。

SD200 Ultra:把 128 颗本土 AI 芯片装进一台机器

元脑 SD200 Ultra 基于本土 AI 芯片,以开放系统设计紧耦合 128 颗芯片,采用 3D Hyper Mesh 架构,提供 8TB 统一编址显存与 64TB 内存,支持 10 万亿参数规模的前沿模型单机运行。官方给出的运行实例是单机承载 2.8 万亿参数的 Kimi K3 大模型,Token 生成时延降到 5.85 毫秒,相当于单用户约 170 Tokens/s,称达到业界平均水平的 5 倍(厂商口径)。底层靠全局统一寻址、对称直连与超级算子优化,压低多芯片协同的通信开销。

这台机器的产品逻辑,是把「超节点」的定义做实:突破单机计算边界,把更多芯片与内存纳入一个高效协同的计算域,为前沿模型提供更大的有效计算空间。在国产算力语境下,基于本土芯片做到 128 卡紧耦合与 8TB 显存统一编址,工程含金量不低——分布式训练可以容忍松耦合,但大规模推理对显存池化与通信时延的要求苛刻得多。

元脑 SD200 Ultra 超节点元脑 HC2000 多元算力机组紧耦合 128 颗本土 AI 芯片8TB 统一编址显存 + 64TB 内存单机承载 2.8 万亿参数 Kimi K3时延 5.85ms / 约 170 Tokens/sDirectCom 2.0 极速架构高密液冷整机柜 + MCIS 软件栈同等投资 Token 产能提升 10 倍负载按需匹配、动态优化均为厂商口径,独立基准待补 · AICC 2026 · 9 月 21 日
浪潮信息 AICC 2026 两款产品关键参数(厂商口径)

HC2000:容量型智算的产品化

元脑 HC2000 多元算力机组采用 DirectCom 2.0 极速架构,基于高密液冷 AI 整机柜,搭配 MCIS 推理软件栈,实现计算负载按需匹配与动态优化;官方称同等投资的 Token 产能提升 10 倍(厂商口径)。它可以围绕不同模型与业务的实际负载,选择相应的算力与存储配置,再由软件栈组织协同。

「多元」二字是关键词:不追求用一种芯片解决所有问题,而是让不同算力各就其位。这背后是对推理负载结构的判断——Prefill 高并行、吃算力,Decode 逐词元串行、吃显存带宽,两类负载的最优硬件并不相同,按负载匹配比堆单点性能更经济。

能力型与容量型:一张两分法框架

浪潮信息首席 AI 战略官刘军在大会期间给出了一个框架:Agent 时代的 AI 计算正在形成两个同样重要的方向。Capability AI Compute(能力型智算)支撑突破智能上限,让 AI 帮助人类探索未知、解决过去解决不了的问题;Capacity AI Compute(容量型智算)实现智能充分供给,让高水平智能越来越丰富、越来越经济、越来越易于获取。

他的表述相当直白:如果每次调用的成本都很高,再强的 AI 也仍然是稀缺资源。智能应当像稳定、廉价的电力一样,从稀缺资源逐步成为整个社会都能获得的基础能力。支撑这个判断的是 Agent 的负载特征——多轮推理、长上下文、工具调用与多智能体协作,使计算瓶颈从单一算力环节延伸至存储、互连、调度和软件栈,AI 计算从单点优化走向面向真实负载的全栈协同。

冷静看:两倍声量与两个保留

两点保留。其一,「业界平均水平 5 倍」「Token 产能提升 10 倍」均为厂商口径,缺少独立基准,实际收益高度依赖具体模型与负载形态,采购方应以自有业务实测为准。其二,「同等投资」的对照基准未披露——是与上一代产品比,还是与竞品同价位配置比,两种口径含义差别很大。

抛开数字,这次发布值得记下的其实是那个两分法:算力行业正在用「能到多高」与「能给多少人」两把尺子给产品定位。当 Token 产出取代峰值算力成为记分卡,比拼的就不只是芯片,而是整机柜架构、液冷、软件栈与调度——这恰好是系统厂商相对芯片厂商的主场。