华为推出全球至快AI训练集群Atlas900

2019-09-25 08:47:01

字体：大中小

来源：转载

供稿：网友

Atlas 900创造全新纪录

据了解，Atlas 900 AI集群主要为大型数据集神经网络训练提供超强算力，可广泛应用于科学研究与商业创新，让研究人员更快地进行图像、视频和语音等AI模型训练，让人类更高效地探索宇宙奥秘、预测天气、勘探石油和加速自动驾驶的商用进程。

Atlas 900 AI集群也可以提供云服务，以云的方式提供充裕的、经济的算力资源，简单易用、高效率、全流程的AI平台，为客户带来极致体验的“易获取、用得起、方便用”的普惠AI算力。为了让各行各业获取超强算力，华为将Atlas 900部署到云上，推出华为云EI集群服务，并以极优惠的价格，面向全球科研机构和大学，即刻开放申请使用。

“这是计算产业新的大航海时代，我们期待的是千帆竞发，而不是独舟奋进。我们期望和各行各业的伙伴共同努力，抓住历史机遇，共创智能新高度。”胡厚崑最后强调。

Atlas 900

代表当今全球算力先锋

在大型数据集上进行训练的神经网络架构涵盖从图像识别、自然语言处理、视频实时分析和智能推荐系统等各个方面，训练这些神经网络模型需要大量浮点计算能力。此次发布的Atlas 900 AI训练集群由数千颗昇腾910 AI处理器互联构成，是当前全球至快的AI训练集群，代表了当今全球的算力极先进水平。其总算力达到256P～1024P FLOPS@FP16，相当于50万台PC的计算能力。其主要亮点如下：

AI算力业界领先

Atlas 900 AI训练集群采用业界单芯片算力至强的昇腾910 AI处理器，每颗昇腾910 AI处理器内置32个达芬奇AI Core，单芯片提供比业界高一倍的算力(256TFLOPS@FP16)。Atlas 900 AI训练集群将数千颗昇腾910 AI处理器互联，打造业界领先的算力集群。

至佳集群网络

Atlas 900 AI训练集群采用“HCCS、PCIe 4.0、100G以太”三类高速互联方式，百TB全互联无阻塞专属参数同步网络，降低网络时延，梯度同步时延缩短10～70%。特创iLossless智能无损交换算法，对集群内的网络流量进行实时的学习训练，实现网络0丢包与E2E μs级时延。

系统级调优

Atlas 900 AI训练集群通过华为集合通信库和作业调度平台，整合HCCS、PCIe 4.0和100G RoCE三种高速接口，充分释放昇腾910 AI处理器的强大性能。

华为集合通信库提供训练网络所需的分布式并行库，通信库+网络拓扑+训练算法进行系统级调优，实现集群线性度>80%，极大提升了作业调度效率。

极致散热系统

传统数据中心多以风冷技术对设备进行散热，但在人工智能时代传统数据中心却面临非常大的挑战。高功耗器件比如CPU和AI芯片带来更大的热岛效应要求更高效的冷却方式。液冷技术可以满足数据中心高功率、高密部署、低PUE的超高需求。

另外，在空间节省方面，与8kW风冷机柜相比，节省机房空间79%。极致的液冷散热技术满足了高功率、高密设备部署、低PUE的需求，极大地降低了客户的TCO。

1024颗昇腾910 AI处理器

华为已在华为云上部署了一个Atlas 900 AI训练集群，集群规模为1024颗昇腾910 AI处理器。基于当前典型的ResNet-50 v1.5模型”和“ImageNet-1k数据集”，Atlas 900AI训练集群只需59.8秒就可完成训练，排名全球领先。

“ImageNet-1k数据集”包含128万张图片，精度为75.9%，在同等精度下，其他两家业界主流厂家测试成绩分别是70.2s和76.8s，Atlas 900 AI训练集群比竞争对手快15%。

2/2 首页上一页 1 2

上一篇：10年后6G将问世速度有望比5G快100倍

下一篇：PayPal进入中国市场金融业开放大提速