10%、3.7倍、36倍!国产IB拿下一张硬核成绩单
全球5公里分辨率、未来10天天气预报约1小时完成。曙光8000这次跑出的结果很猛,背后的三组优化数据更值得细看。
计算资源利用率提升10%,说明GPU少花时间处理显存申请、释放和重复创建;通信模块算法加速3.7倍,意味着数千张卡交换网格数据时少了大量等待;I/O性能提升36倍,则让海量预报结果能够及时写入存储。
这三处只要有一个堵住,最终时效都跑不出来。
其中通信部分,并不是只靠增加网络带宽,而是基于曙光8000的scaleFabric类IB高速互连,继续优化插值计算、通信合并、数据打包和GPU Direct D2D。网络提供低时延的数据通道,算法负责减少不必要的消息和中转。
这就是高性能计算真正讲究的系统能力。加速卡负责算,高速网络负责传,存储负责接,应用团队再把三者调到同一个节奏。
因此,这次MCV进入全球第一梯队,也顺手给国产IB和国产并行存储做了一次高强度验收。世界级成果,从来不是靠某一个部件单打独斗。
曙光8000 异构计算国产IB
