华为昇腾960超节点:重塑AI算力的未来
在AI技术日益发展的背景下,华为于2026年9月17日在上海的全联接大会上推出了昇腾960超节点。这一计算系统集成了4096个卡片,具备8 EFLOPS FP8的算力和1PB的HBM内存,同时首次使用了NPO光互联技术。昇腾960超节点不仅仅是一台更强大的AI服务器,它深刻地影响了整个AI产业。
过去,AI的发展遵循着简单的逻辑:模型规模增大,需求更多的算力,算力不够时便堆砌卡片。然而,当前模型参数正快速攀升,面临巨大的算力需求,传统的方法已近物理极限。这使得算力的有效利用成为一大挑战,尤其是当卡片数量增多时,通信和数据交换的问题日渐突出。
随着卡片规模达到十万甚至百万级,算力的组织比单纯增加设备更为重要。传统的集群结构面临着高通信成本,使得如何高效组织算力成为关键。华为的超节点系统则通过统一的内存寻址,使分散的计算资源在逻辑上更像一个整体,提升了算力的利用效率。 球友会登录
在WAIC 2026的会议上,鹏城实验室与全球计算联盟联合推出《超节点定义与实践白皮书》,为超节点设立了行业标准,强调跨物理节点的统一内存编址能力。昇腾960作为这一思路的实用化代表,将计算、光通信、网络、存储和软件的能力整合进了同一个AI计算体系。
在这一过程中,华为不断突破传统产业的技术边界,尤其是在光通信领域,通过将电信号转化为光信号,极大地提高了传输能力,降低了功耗,显著提升了系统的可用性。此外,鲲鹏与存储的整合,则为AI推理和复杂任务的执行提供了更强的支撑。
最终,昇腾960超节点并不仅仅是提升了算力的单一工具,而是将计算、光、通信、内存、存储、网络和软件形成了一个协同发展的系统。这种多学科系统工程能力的整合,使得华为在AI时代迎来了新的发展机遇。根据华为的仿真数据显示,采用4K超节点的10万卡集群在算力利用方面表现出了显著优势。至今,昇腾超节点已规模商用超过1000套,标志着其在AI行业的广泛应用。 球友会登录