AI 圈大事记

浪潮信息发布元脑SD200 Ultra与HC2000,破解能力与容量双重算力瓶颈

产品AI 评分 85/100量子位待复核
AI 聚合

本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手

在AICC2026上,浪潮信息针对AI算力“堆卡失效”困境,发布超节点服务器“元脑SD200 Ultra”与多元算力机组“元脑HC2000”。SD200 Ultra采用3D Hyper Mesh架构,芯片数从64增至128颗,显存8TB、扩展存储64TB,单机可装下并运行2.8万亿参数的Kimi K3模型,解决前沿大模型装不下、跑不稳的能力上限问题。HC2000则针对Agent时代多元推理负载,解决算力供给成本与规模问题。IDC报告显示,到2030年全球Token消耗复合增长率达4822.6%,算力缺口绝对值将扩至3809亿美元,单纯堆卡已致资源配比失衡。

全文梳理

AI 摘要依据下方信源原文自动整理,非原文转载

Agent爆发重塑算力需求

Agent接管任务使算力调用从单次脉冲变为持续长流负载。IDC报告揭示三个乘法叠加因子:到2030年全球推理任务增长4000万亿次;单任务Token消耗从几十个增至几十万个;多智能体协同放大任务链路。这使今年至2030年全球Token消耗复合增长率飙至4822.6%。然而算力供给滞后,满足率将从2024年的79%降至2027年的71%,2030年仅恢复至77%。因基数膨胀,2030年算力缺口绝对值将达3809亿美元,近2024年十倍。

多元负载击碎堆卡模式

Agent时代推理负载多元,Prefill高并行高计算密度,Decode串行吃内存带宽,Attention频访KV Cache,MoE需稀疏路由,多模态有独立Encoder。随对话轮次增加,上下文从一两万扩至三四十万Token,系统瓶颈在计算、显存、带宽和通信间动态转移。单纯堆卡无法线性扩容,反致资源配比失衡,部分闲置部分过载。浪潮信息首席AI战略官刘军将此归纳为能力型智算与容量型智算,前者突破智能上限,后者扩充智能供给规模。

SD200 Ultra突破能力上限

针对前沿模型装不下、跑不快、跑不稳的能力瓶颈,浪潮信息推出超节点AI服务器元脑SD200 Ultra。其沿用3D Hyper Mesh架构实现紧致扩展,将芯片数量由64颗翻倍至128颗,显存与扩展存储分别提至8TB和64TB。通过将计算、存储与通信资源压缩于单一物理边界,该单机可装下并高效运行2.8万亿参数的全球最大开源模型Kimi K3,解决从0到1的模型运行前提。

HC2000化解容量产能焦虑

针对容量型智算需以低成本充足供给智能的问题,浪潮信息发布多元算力机组元脑HC2000。该产品旨在应对Agent时代特征各异的推理负载,化解单一算力无法覆盖Prefill、Decode等不同计算特征的困境,瓦解算力产能焦虑,让更多企业与用户用得起AI智能,避免算力缺口随需求基数急速膨胀而进一步恶化。

为什么值得看

Agent爆发致算力需求质变,单靠堆卡致资源失衡,浪潮双产品直击大模型运行上限与推理成本痛点。

大模型算力芯片

信源1

  1. [1]量子位AI算力之争不靠堆卡!浪潮信息捅破智算「能力天花板」,还瓦解了「产能焦虑」

关键事实

  • 浪潮信息在AICC2026发布超节点AI服务器“元脑SD200 Ultra”和多元算力机组“元脑HC2000”。[1]

  • SD200 Ultra芯片数从64颗增至128颗,显存8TB,扩展存储64TB,单机可运行2.8万亿参数的Kimi K3模型。[1]

  • IDC报告预测到2030年全球Token消耗量复合增长率达4822.6%,算力缺口绝对值将达3809亿美元。[1]

  • AI算力需求分化为能力型智算(Capability)与容量型智算(Capacity),前者撑起智能上限,后者降低智能生产成本。[1]

相关 · 产品

本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。