亚马逊云服务(AWS)今日推出了基于GPU的新P4实例,此时距离该公司的首套GPU集群实例上线已有十年。具体说来是,P4实例采用了英特尔CascadeLake处理器+8路Nvidia100TensorFlowCoreGPU的方案。AWS承诺新实例提供的深度学习性能是前一代的2.5倍,模型训练的性价比也有60%的优势。
目前AWSP4GPU实例仅提供了一种选项(p4d.12xlarge),8路@NvidiaGPU通过NVLink接口实现通信连接,此外也提供了对GPUDirect接口的支持。
凭借320GB的高带宽GPU显存和400Gbps网络,再加上96个CPU核心、1.1TB系统内存、以及8TBSSD存储,这套平台的性能也是相当惊人。
按需使用的话,AWSP4GPU实例的价格为32.77美元/小时。如果长期使用,那年费平均下来20美元/小时(三年平均11.57美元/小时)。
AnnouncingtheNewAmazonEC2P4dInstances(via)
在极端情况下,用户最高可选将4000+GPU组合到一个EC2UltraCluster集群中。但考虑到实际运算的成本,也只有少数企业客户能够承担得起,比如参与早期测试的丰田研究院、GEHealthcare和Aon。
400-880-6932