商业通讯
请输入关键词
  • 首页
  • 资讯
  • 科技
  • 财商
  • 汽车
  • 家电
  • 生活
 > 财商

华为推出OceanStor M900 AI记忆存储,加速超大规模数据中心AI推理

发布于:2026-09-17 20:51:00 来源:Huawei

上海2026年9月17日 美通社 -- 华为全联接大会2026期间,华为副董事长、轮值董事长汪涛在主题演讲中,正式推出OceanStor M900 AI记忆存储。面向超大规模数据中心AI推理场景,该产品为超节点提供PB级大容量、TB级高性能的全共享记忆空间,推动AI基础设施从以计算为中心,迈向计算、网络与存储深度协同的新阶段,进一步释放超节点算力潜能。

2026年,人工智能加速从技术突破走向规模应用,AI应用从Chatbot对话进一步演进为能够自主完成复杂任务的智能体,并加速进入科研、医疗、金融和公共服务等关系国计民生的重要领域,人类社会由此进入Agentic AI时代。

随着大模型迈向10T级参数规模,超节点成为AI基础设施建设的必然选择,同时业界主流大模型的上下文窗口已突破百万词元,多轮推理和复杂任务成为常态,推理过程中产生的KV Cache数据规模持续增长,显存和内存容量与性价比均已无法满足需求。构建显存、内存与SSD协同的多级存储体系,打造大容量的全共享记忆空间,已成为行业共识。

为了突破超长上下文、多轮推理场景的内存容量瓶颈,华为全新推出的OceanStor M900 AI记忆存储,利用灵衢网络构建了“一跳直通”的PB级全局KV Cache多级缓存方案,充分释放超节点的算力潜能,加速超大规模数据中心AI推理,其具备三大核心能力:

打破容量边界,让大规模AI拥有更充足的记忆

依托灵衢高速互联网络,实现KV Cache的全局池化共享和分级存储,将超节点的KV Cache从显存与内存扩展至SSD,单集群可提供64PB容量,单NPU可用KV Cache容量从GB级提升至TB级,让更多上下文得以保存、共享和复用,大幅提升KV Cache缓存命中率。

跃升推理性能,让算力释放更充分

业界首创的CPU、网络、盘控三芯合一架构,提供原生KV语义,实现超节点的NPU一跳直通到SSD,避免协议转换和CPU转发,访问时延由ms级降至60μs,缩短90%;单集群可提供40TBs聚合访问带宽,相比业界方案提升1.5倍。在典型AI编程场景中,可实现推理集群Token吞吐率翻倍、首Token时延缩短一半,让算力更快转化为生产力。

降低Token成本,让AI规模化应用更经济

采用业界首创的KV-Aware自适应存储技术,根据KV Cache数据价值预测生命周期,对多模介质上的数据排布进行智能调度,实现最高24 DWPD,使得SSD介质寿命提升16倍,支撑三年稳定运行;通过减少介质更换和运维投入,降低大规模AI推理基础设施的长期成本,加速人工智能规模化普及。

面向未来,随着人工智能加速进入各行业核心生产系统,AI基础设施将由单纯追求算力规模,进一步迈向算力、网络与存力的系统协同,AI记忆存储将成为持续提升超大规模推理KV Cache容量与访问效率的必然选择。华为将不断推进软硬件协同和系统级创新,打造开放、高效、可持续的AI基础设施,为人工智能技术进步、产业智能化升级提供坚实支撑。

上一篇:赛诺菲出席2026年上海国际生物医药产业周

下一篇:

热门文章

  • 专为牙齿敏感设计:锐舞喷气式牙刷跳出震动内卷,开辟温和清洁新路径

    2026-05-13
  • 责任•创新•未来:药明生物发布2024年《可持续发展报告》

    2025-04-29
  • 2026七夕电动牙刷推荐榜单:牙龈出血、牙痛人群首选锐舞SPA5喷气式

    2026-08-14
  • 匹克携手罗马尼亚奥委会,再启八年荣耀新征程

    2025-04-11
  • 窝窝优加发布“共享家电+AI家庭算力”新模式,智慧家庭进入“订阅时代”

    2026-07-31
  • 雪川小薄仕脆薯饼斩获年度品类心智战略奖

    2026-07-21

本站部分文字及图片均来自于网络,如有侵权请及时联系删除处理

Copyright ©2023-2024 商业通讯.Powered by © hubeizhichuang.com