在短短两个月内,中科曙光scaleX万卡超集群就完成从方案到实战的关键跨越,正式进入国内AI大模型及行业智能化重大工程应用阶段,并部署至国家级算力节点项目。
最新消息,由中科曙光提供的3套万卡超集群系统在国家超算互联网核心节点同时上线试运行,成为全国首个实现3万卡部署且实际投入运营的最大国产AI算力池,全面覆盖万亿参数模型训练、高通量推理、AI for Science等大规模AI计算场景。

业内认为,这对国产智算算力发展是一个标志性事件,万卡级以上算力集群终于突破工程化落地难题,不仅实现了0到1的关键跨越,更刷新单体国产AI算力池的记录,标志着我国超大规模智算基础设施的建设与运营能力迈入世界前列。
根据相关媒体报道,本次上线的万卡超集群除了落地规模可观,在实用性上也可圈可点,不仅完成400多个主流大模型、世界模型的适配优化,还依托国家超算互联网接入上千款应用,实现“算力+应用”一体化交付,做到了“上线即实战”。
目前,scaleX万卡超集群不管是AI大模型训推、金融风控,还是地质能源勘探、科学智能,全场景都能覆盖。
这离不开背后的多项技术突破。
首先是极速互联技术。这套自主研发的scaleFabric互联方案,搭建的是国内首款400G 类InfiniBand原生RDMA网卡和交换芯片,端侧通信延迟压到了1微秒以内。更狠的是,集群规模能轻松扩展到10万卡以上,同时网络成本还降了 30%。既解决了大模型训练的通信瓶颈,又控制了成本,这波性价比拉满。
其次是全链路深度优化。从芯片到系统再到应用,搞了三级协同优化,直接把AI加速卡资源利用率提升了55%。大模型训练时最头疼的万卡并发读写问题,存力平台也能轻松扛住,响应速度肉眼可见地提升。
最后是智能运维稳定。引入了物理集群数字孪生技术,故障定位和修复全流程可视化,智能化运维平台更是把集群长期可用性拉到99.99%,还能支撑每秒万级作业调度,对需要稳定算力的科研和企业来说,这稳定性简直是刚需。
硬核技术之外,开放架构则是万卡超集群快速发展的关键催化剂。众所周知,全球算力市场长期以来都要看英伟达的脸色,国内智算领域也不例外,不是国产卡性能不能打,而是生态壁垒太多。而scaleX万卡超集群直接打破了这个困境,通过开放架构体系支持多品牌加速卡兼容,真正实现了多芯兼容和生态协同。
对AI行业而言,这意味着开发效率有望直接翻倍,以前适配算力要花几个月,现在可能几周就能搞定。对国家而言,这套算力底座则能为重大战略和产业智能化升级提供强劲支撑,充分赋能千行百业。
新年伊始,中科曙光scaleX万卡超集群祭出的国内最大单体国产AI算力池,无疑给蓄力已久的国产智算产业注入了一剂强劲强心针。从技术突破到生态开放,再到规模化应用落地,每一步都踩在了行业痛点上,真正实现了国产超大规模智算从“能落地”到“强落地”的跨越。
随着这套算力底座全面释放效能,相信各大科研机构与企业将以此为支点,在万亿大模型研发、AI for Science探索、千行百业智能化升级中解锁更多创新可能,国产智算也将借此乘势而上,在全球算力竞争中抢占更有利位置。




