在华为全联接大会期间,一场聚焦AI数据中心(AI DC)创新发展的峰会吸引了全球目光。来自世界各地的行业客户、合作伙伴以及产业领袖齐聚于此,共同探讨Agentic时代下AI DC的创新路径与未来走向。华为副总裁、ICT产品组合管理与解决方案部总裁马海旭在峰会上发表了主题演讲,深入剖析了AI DC的发展趋势与华为的创新实践。
马海旭指出,随着Agentic时代的全面来临,数据中心正加速向AI DC演进,呈现出大功率与高密度的显著特征。在智算负载的驱动下,AI DC从设施到应用都在经历深刻重构。在AI Facility层面,液冷散热、高压直流供电以及3D数据中心成为主要演进方向;AI Infra领域,智算超节点成为标配,通算走向高密CPU,KV Cache采用分级存储,超大带宽超低时延的数据中心网络成为关键支撑;而在AI Application方面,以Agent为中心的模式逐渐兴起,万级Agent与EB级多模态数据正推动Agent基础设施建设,对海量沙箱秒级启动和长稳可信执行能力提出了更高要求。
面对AI DC重构带来的诸多挑战,华为在智算、通算与存储、网络与DC设施等多个领域推出了一系列创新方案,助力客户构建具备超高训推性能和极致Token效率的AI DC基础设施。
在智算领域,华为推出了新一代智算超节点。面向万亿级模型,基于灵衢架构打造的昇腾960超节点,具备异构算力、分级存储、灵活组网和光电互联等关键能力。以Atlas 960液冷超节点为例,其性能全面升级,最大可提供8E Flops算力,相比上一代,网络带宽增长4倍,RTT时延降低1/3,内存容量提升8倍,为大规模模型训练提供了强大的算力支持。
为满足更大规模的算力需求,华为还推出了十万卡级超节点集群。该集群最高规模可达12.8万卡,采用极简组网方式,TCO节省30%。通过CCAE Agent和智能化断点续训等创新技术,能够实现分钟级故障定位和恢复;同时,基于内存语义与算子的深度融合,MFU利用率可超30%,有效提升了集群的整体性能和可用性。
在面向超长上下文推理的场景中,华为的KV Cache多级缓存方案表现出色。该方案构建了PB级多级缓存共享池,可按需调度,命中率超90%;基于灵衢总线实现NPU直通SSD,时延降低90%;搭载SLC/TLC动态双模与全局磨损均衡技术,SSD擦写次数超10倍,在性能、体验和成本方面实现了综合最优。
为了支撑万级Agent高效精准推理,华为打造了鲲鹏超节点和AI高性能存储。鲲鹏950超节点和AI高性能存储的组合,可实现海量沙箱毫秒级拉起;通过openGauss+NPU协同加速,200万条向量索引构建时长小于3分钟,为万级Agent应用提供了精准推理的有力保障。
针对边缘算力部署场景,华为推出了轻量推理一体化方案。该方案将昇腾、鲲鹏与网络设备打造为一体化典配,简化了机房部署流程。支持单机起步、弹性扩展,主流开源模型可一键部署,并融入KV Cache多级缓存技术,使推理性能提升3倍,让企业能够轻松使用AI算力,实现开箱即用。
在网络与DC设施领域,华为致力于打造超宽无损的数据中心网络。通过超融合Token Centric Fabric,采用包级负载均衡、智能IO流量调度等创新技术,助力推理吞吐提升20%,训练效率提升7%。面向跨DC训推协同,构建全光无损DCI网络,利用RDMA无损拉远技术,千公里算效大于98%,充分释放了算力潜能。
华为还提出了3D数据中心的概念,为液冷AI超节点提供了机房标准参考。3D数据中心采用一层制冷、二层IT、三层配电的架构,楼顶配置电池与冷却塔,实现了算力的高效集约承载。其具有三大优势:3D架构缩短了NPU通信距离,垂直供电供冷路径短,可实现单机楼10万卡超高密度;架构解耦、弹性建设,能够实现月级敏捷交付;采用冷板液冷和能效智能调优技术,年均PUE处于行业领先水平。
华为将持续深耕根技术,围绕昇腾和鲲鹏构建开源开放的算力生态,为行业智能化发展打造坚实的算力底座,与全球客户和伙伴携手共创智能世界的美好未来。







