曙光8000十万卡集群实测:WAIC上的"镇馆之宝"如何扛住百万级并发?
十万卡不是PPT里的数字
在世界人工智能大会(WAIC)上海世博展览馆H2馆B116展位,曙光8000真机陈列专区是人流最密集的区域之一。作为大会官方评出的"镇馆之宝",这台中国首个全国产十万卡AI超集群"登峰",通过实时跳动的数字孪生算力大屏,让"十万卡"这个过去只出现在PPT里的数字第一次变得看得见摸得着。
展台旁边陈列着IO500存储认证展示墙和行业落地案例展板,但热闹只是表面——真正的答卷在机房里。
上线首周即满载
7月18日,曙光8000公布了一份数据:上线首周就跑满了。
- 日均处理作业数突破15万个
- 单日峰值超过50万个
换句话说,观众在展台前排队体验的这几天,十万张卡已经在后台连轴转了一整周。
目前曙光8000已完成近千项超智融合应用适配,覆盖大模型训练、高通量推理、科学计算等多个万卡级场景。刚上线就满载,说明科研机构、企业和开发者对超大规模高质量算力的需求早就攒着了,也说明十万卡级算力开始真正接得住这些任务,不再只是概念。
满载不等于堵车
十万卡稳定跑起来,靠的从来不是某一项性能突出,而是整套系统能不能协同工作。面对百万级用户并发请求,曙光8000在高负载下依然能做到"高负载不拥堵、多任务不排队"。
其核心技术支撑包括:
- 智能调度引擎与数据亲和性算法:根据任务类型、数据位置和资源状态做智能分流
- 全球首创的高密度机柜结构:单个计算单元算力密度比其他超节点高20倍,同样空间能塞进更多算力
- 自研scaleFabric类IB原生RDMA互连技术:不用光通讯也能把十万卡稳稳连起来
- ParaStor分布式存储:拿下2026年IO500生产型全节点、10节点两项全球第一
- 全球领先的浸没式相变液冷散热:撑住海量数据的高效流转和系统的长期稳定
从"重大基础设施"到公共服务
作为超算互联网的核心节点,曙光8000正通过三大计划降低高端算力的使用门槛:
- 十万卡共创者激励计划
- 智能体生态共创与招募计划
- 核心生态伙伴招募计划
企业、科研团队和开发者不用自己建集群,接进来就能按需调用算力,高端算力也就这样从"重大基础设施"变成了一项能用得起、用得上的公共服务。
结语
展台前排队体验的观众,看到的是WAIC给公众的一次"十万卡"科普;机房里满负荷运转的曙光8000,才是这个数字真正落地之后的样子。
首周满载、近千项应用适配,加上高负载下依然稳定,超大规模AI基础设施到底好不好用,现在看的已经不是规模数字,而是能不能真正扛住实际的活儿。