曙光8000十万卡国产AI超算集群落地:核心采用浸没式相变液冷方案

驱动之家
 来自北京

快科技9月27日消息,中科曙光曙光8000(登峰)作为国内首个全国产十万卡AI超算集群,核心采用浸没式相变液冷方案,直面超大算力集群最突出的散热难题。

随着AI加速卡规模拉至十万卡级别,芯片功率密度大幅抬升,传统风冷、冷板散热已接近物理上限,高温会造成芯片降频、集群稳定性下滑,液冷成为释放国产高算力芯片性能的关键支撑。

这套浸没式相变液冷方案,将计算卡、主板等元器件整体浸泡在绝缘冷却液中,依靠介质受热沸腾相变快速带走热量,形成闭环循环换热。

和传统风冷相比,散热密度显著提升,同时可压缩机房占地,整机能耗降低约40%,集群PUE可低至1.04,解决十万卡高密度部署下的持续温控压力,保障大模型长时训练不因为过热降速。

曙光8000实现芯片、计算、存储、高速网络全链路国产自主可控,采用超智融合架构,兼顾AI大模型训练推理与高精度科学计算。

集群搭载自研scaleFabric高速网络与高性能分布式存储,支撑十万卡规模下的大规模并行通信,适配新材料、生物医药、气象仿真等AI for Science场景,目前已接入国家超算互联网。

这套集群落地,不仅验证国产算力硬件的大规模协同能力,也证明自研浸没相变液冷可以支撑十万卡级超大规模智算工程。

在算力需求持续暴涨的背景下,液冷不再是可选优化,而是国产超大规模AI集群规模化落地的基础设施底座,为后续更大规模国产算力集群建设提供可复制的工程样本。

曙光8000十万卡国产AI超算集群落地:核心采用浸没式相变液冷方案

“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。

Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”

热点新闻