华为推出OceanStor M900 AI记忆存储,加速超大规模数据中心AI推理
上海2026年9月17日 /美通社/ -- 华为全联接大会2026期间,华为副董事长、轮值董事长汪涛在主题演讲中,正式推出OceanStor M900 AI记忆存储。面向超大规模数据中心AI推理场景,该产品为超节点提供PB级大容量、TB级高性能的全共享记忆空间,推动AI基础设施从以计算为中心,迈向计算、网络与存储深度协同的新阶段,进一步释放超节点算力潜能。
2026年,人工智能加速从技术突破走向规模应用,AI应用从Chatbot对话进一步演进为能够自主完成复杂任务的智能体,并加速进入科研、医疗、金融和公共服务等关系国计民生的重要领域,人类社会由此进入Agentic AI时代。
随着大模型迈向10T级参数规模,超节点成为AI基础设施建设的必然选择,同时业界主流大模型的上下文窗口已突破百万词元,多轮推理和复杂任务成为常态,推理过程中产生的KV Cache数据规模持续增长,显存和内存容量与性价比均已无法满足需求。构建显存、内存与SSD协同的多级存储体系,打造大容量的全共享记忆空间,已成为行业共识。
为了突破超长上下文、多轮推理场景的内存容量瓶颈,华为全新推出的OceanStor M900 AI记忆存储,利用灵衢网络构建了"一跳直通"的PB级全局KV Cache多级缓存方案,充分释放超节点的算力潜能,加速超大规模数据中心AI推理,其具备三大核心能力:
打破容量边界,让大规模AI拥有更充足的记忆
依托灵衢高速互联网络,实现KV Cache的全局池化共享和分级存储,将超节点的KV Cache从显存与内存扩展至SSD,单集群可提供64PB容量,单NPU可用KV Cache容量从GB级提升至TB级,让更多上下文得以保存、共享和复用,大幅提升KV Cache缓存命中率。
跃升推理性能,让算力释放更充分
业界首创的CPU、网络、盘控三芯合一架构,提供原生KV语义,实现超节点的NPU一跳直通到SSD,避免协议转换和CPU转发,访问时延由ms级降至60μs,缩短90%;单集群可提供40TB/s聚合访问带宽,相比业界方案提升1.5倍。在典型AI编程场景中,可实现推理集群Token吞吐率翻倍、首Token时延缩短一半,让算力更快转化为生产力。
降低Token成本,让AI规模化应用更经济
采用业界首创的KV-Aware自适应存储技术,根据KV Cache数据价值预测生命周期,对多模介质上的数据排布进行智能调度,实现最高24 DWPD,使得SSD介质寿命提升16倍,支撑三年稳定运行;通过减少介质更换和运维投入,降低大规模AI推理基础设施的长期成本,加速人工智能规模化普及。
面向未来,随着人工智能加速进入各行业核心生产系统,AI基础设施将由单纯追求算力规模,进一步迈向算力、网络与存力的系统协同,AI记忆存储将成为持续提升超大规模推理KV Cache容量与访问效率的必然选择。华为将不断推进软硬件协同和系统级创新,打造开放、高效、可持续的AI基础设施,为人工智能技术进步、产业智能化升级提供坚实支撑。
[美通社]【免责声明】本文仅代表作者个人观点,与云财经无关。其原创性以及文中陈述文字和内容未经本站证实,云财经对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。
| 新闻标题 | 时间 | 消息来源 | 新闻热度 |
|---|---|---|---|
| 优傲机器人发布全新Gen 7平台 赋能工业自动化与物理AI规模化部署 | 09-16 17:51 | 商业新闻 |
|
| 港股光通信股走强 海光芯正涨近6% | 09-16 09:40 | 云财经 |
|
| 煜荣集团:控股股东已出售1.76亿股,占38.54% | 09-16 07:06 | 云财经 |
|
| 美元指数15日上涨 | 09-16 03:41 | 云财经 |
|
| KNIC将南隆城打造为数据中心枢纽 深化粤港澳大湾区与越南投资纽带 | 09-15 15:09 | 商业新闻 |
|
| 浙商证券:维持三一重工“买入”评级,下半年业绩有望提速 | 09-15 15:00 | 云财经 |
|