浪潮信息发布元脑SD200 Ultra与HC2000,破解能力与容量双重算力瓶颈
本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手。
全文梳理
AI 摘要依据下方信源原文自动整理,非原文转载Agent爆发重塑算力需求
Agent接管任务使算力调用从单次脉冲变为持续长流负载。IDC报告揭示三个乘法叠加因子:到2030年全球推理任务增长4000万亿次;单任务Token消耗从几十个增至几十万个;多智能体协同放大任务链路。这使今年至2030年全球Token消耗复合增长率飙至4822.6%。然而算力供给滞后,满足率将从2024年的79%降至2027年的71%,2030年仅恢复至77%。因基数膨胀,2030年算力缺口绝对值将达3809亿美元,近2024年十倍。
多元负载击碎堆卡模式
Agent时代推理负载多元,Prefill高并行高计算密度,Decode串行吃内存带宽,Attention频访KV Cache,MoE需稀疏路由,多模态有独立Encoder。随对话轮次增加,上下文从一两万扩至三四十万Token,系统瓶颈在计算、显存、带宽和通信间动态转移。单纯堆卡无法线性扩容,反致资源配比失衡,部分闲置部分过载。浪潮信息首席AI战略官刘军将此归纳为能力型智算与容量型智算,前者突破智能上限,后者扩充智能供给规模。
SD200 Ultra突破能力上限
针对前沿模型装不下、跑不快、跑不稳的能力瓶颈,浪潮信息推出超节点AI服务器元脑SD200 Ultra。其沿用3D Hyper Mesh架构实现紧致扩展,将芯片数量由64颗翻倍至128颗,显存与扩展存储分别提至8TB和64TB。通过将计算、存储与通信资源压缩于单一物理边界,该单机可装下并高效运行2.8万亿参数的全球最大开源模型Kimi K3,解决从0到1的模型运行前提。
HC2000化解容量产能焦虑
针对容量型智算需以低成本充足供给智能的问题,浪潮信息发布多元算力机组元脑HC2000。该产品旨在应对Agent时代特征各异的推理负载,化解单一算力无法覆盖Prefill、Decode等不同计算特征的困境,瓦解算力产能焦虑,让更多企业与用户用得起AI智能,避免算力缺口随需求基数急速膨胀而进一步恶化。
为什么值得看
Agent爆发致算力需求质变,单靠堆卡致资源失衡,浪潮双产品直击大模型运行上限与推理成本痛点。
信源1 家
关键事实
相关 · 产品
本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。
