文/科技日报
随着国内AI产业的发展,单纯比拼算力规模的粗放增长已经结束,科学智能、产业大模型深度落地成为了新常态,只有依靠超智融合一体化技术路线才能实现系统性跨越。
7月9日至11日,光合组织2026智能计算应用大会在郑州举办,大会期间国内首套全国产十万卡AI超集群曙光8000(登峰)正式落成,以原生超智融合技术路线,为我国下一代自主可控AI算力基础设施划定清晰技术路径。
超智融合原生一体化,破除多精度算力协同壁垒
“伴随大模型、科学智能与通用智能体快速落地,国内算力基础设施正由千卡、万卡集群向着超大算力规模迭代升级。”业内专家指出,十万卡级AI超集群将不再是单纯的规模数字,已然成为衡量下一代AI基础设施综合实力的核心门槛。
记者了解到,曙光8000是国内首个原生落地超智融合技术路线的全国产十万卡算力底座。产品在顶层架构层面打破传统超算、智算物理分区的建设模式,在一套集群内部完成FP64至INT8全谱系计算精度统一调度。单套算力平台兼顾基础科学高精度仿真、大模型训推、工业仿真、智能体推理等多样化任务,从底层化解跨集群数据传输损耗、算力硬件重复建设的行业难题。
中科曙光高级副总裁李斌指出,十万卡集群绝非万卡系统的简单堆叠。集群围绕“芯片、计算、存储、网络、散热、应用、服务”构建七位一体全链路国产自研技术体系,实现核心软硬件全国产自主可控。
凭借自研scaleFabric高速互连网络,曙光8000保障十万卡规模节点稳定互连;配套ParaStor分布式存储系统,从容承接大模型训练与高精度仿真带来的海量数据读写需求;浸没式相变液冷方案最高支持兆瓦级单机柜功率,借助国产自研冷媒、全年自然冷却模式,在高密度算力条件下持续降低能耗水平。
与此同时,基于开放计算生态、算力服务能力,曙光8000可为各类科研机构、行业用户和应用开发者提供从底层算力到应用适配的全面支撑。
十万卡算网全面开放,300余项前沿应用验证超智融合价值
据悉,曙光8000依托国家超算互联网接入全国一体化算力调度网络,将面向科研高校、企业及个人用户开放普惠式超智融合算力资源,实现国家级大规模算力跨区域共享运营。
李斌介绍,在十万卡核心节点上,目前已完成300余项重点应用深度适配优化,覆盖大模型、机器人、汽车、创新药、新材料、量子计算、天文气象等20余个前沿领域,充分验证了全国产十万卡集群在长周期、超高并发科研任务中的稳定可靠性。
业内专家表示,海量落地实践表明,超智融合架构大幅降低科研机构、制造企业多套算力集群建设运维成本,实现高精度科学计算与AI模型开发资源互通,将大规模硬件算力转化为可量化的原始创新生产力与产业升级动能。
此外,记者还了解到曙光8000作为光合组织开放架构标杆载体,为开放计算Token谱系提供标准化算力计量基准,依托十万卡异构集群海量运行数据,统一不同硬件算力产出测算口径,补齐了国产算力价值量化体系的短板,推动行业发展逻辑从“堆砌硬件”向“高效运营算力”转型。
十万卡工程落地,国产超智融合算力迈入规模化复制时代
“首套全国产十万卡AI超集群曙光8000落地只是开始,规模化运用才是最具产业发展的最终需要”,记者在现场了解到,本次大会中科曙光宣布与北京科学智能研究院达成深度战略合作,双方正式启动第二套全国产十万卡超智融合算力系统研制与建设。
“首套曙光8000完成架构、软硬件、运维、应用全流程标准闭环验证,第二套十万卡工程同步启动研发,标志十万卡级全国产超智融合算力彻底跳出单一示范工程阶段,进入多点规划、批量落地的产业化快车道。”业内人士表示,当前全球AI产业回归理性务实发展路径,AI4S基础科研突破、实体经济“人工智能+”转型均对全精度、超大规模自主算力存在长期刚性需求。
未来,两套十万卡集群同步推进,跑通超智融合算力中心从设计、建设、调试到场景落地的全套标准化工程模板,为全国各区域智算中心建设提供成熟可复用方案,十万卡级全精度超智算力基础设施有望成为新型数字基建标配。(完)