AI算力领先
Atlas 900 AI训练集群采用业界单芯片算力最强的昇腾910 AI处理器,每颗昇腾910 AI处理器内置32个达芬奇AI Core,单芯片提供比业界高一倍的算力。Atlas 900 AI训练集群将数千颗昇腾910 AI处理器互联,打造业界第一的算力集群。
昇腾910 AI处理器采用SoC设计,集成“AI算力、通用算力、高速大带宽I/O”,大幅度卸载Host CPU的数据预处理任务,充分提升训练效率。
最佳集群网络
Atlas 900 AI训练集群采用“HCCS、 PCIe 4。0、100G以太”三类高速互联方式,百TB全互联无阻塞专属参数同步网络,降低网络时延,梯度同步时延缩短10~70%。
在AI服务器内部,昇腾910 AI处理器之间通过HCCS高速总线互联;昇腾910 AI处理器和CPU之间以最新的PCIe 4。0(速率16Gb/s)技术互联,其速率是业界主流采用的PCIe 3。0(8。0Gb/s)技术的两倍,使得数据传输更加快速和高效。在集群层面,采用面向数据中心的CloudEngine 8800系列交换机,提供单端口100Gbps的交换速率,将集群内的所有AI服务器接入高速交换网络。
独创iLossless 智能无损交换算法,对集群内的网络流量进行实时的学习训练,实现网络0丢包与E2E μs级时延。
2024-04-30 09:36:49
2024-04-30 09:18:38
2024-04-29 09:21:04
2024-04-29 09:30:13
2024-04-28 09:36:18
2024-04-28 09:30:59
2024-04-26 09:31:29
2024-04-26 09:44:40
2024-04-25 09:56:50
2024-04-25 09:53:31
2024-04-24 11:07:23
2024-04-24 11:09:22
2024-04-22 10:35:22
2024-04-22 10:40:16