内容提要
Amazon EC2 P6e-GB200 UltraServers 正式发布,搭载 NVIDIA GB200 NVL72 加速器,支持多达 72 个 GPU,提供高达 28.8 Tbps 的网络带宽,适合大规模 AI 训练和推理任务。
关键要点
-
Amazon EC2 P6e-GB200 UltraServers 正式发布,搭载 NVIDIA GB200 NVL72 加速器,支持多达 72 个 GPU。
-
该服务器提供高达 28.8 Tbps 的网络带宽,适合大规模 AI 训练和推理任务。
-
NVIDIA Grace Blackwell 超级芯片采用 NVLink-C2C 互连技术,提供 10 千亿次浮点运算的 FP8 计算能力和高达 372 GB 的 HBM3e 内存。
-
通过 EC2 P6e-GB200 UltraServers,用户可在一个 NVLink 域内使用多达 72 个 NVIDIA Blackwell GPU,获得 360 千亿次浮点运算的 FP8 计算能力。
-
EC2 P6e-GB200 UltraServers 支持多种配置选择,适用于计算和内存密集型 AI 工作负载。
-
用户可以构建智能代理式和生成式人工智能应用程序,涵盖多个领域。
-
EC2 P6e-GB200 UltraServers 现已在达拉斯本地扩展区推出,用户可通过 EC2 控制台预留容量块。
-
成功预订容量块后,用户可使用 AWS 管理控制台、AWS CLI 或 AWS SDK 运行实例。
-
EC2 P6e-GB200 UltraServers 可与各种 AWS 托管服务无缝集成。
延伸解读
高性能计算的优势
EC2 P6e-GB200 UltraServers 通过支持多达 72 个 NVIDIA Blackwell GPU,提供强大的计算能力,适合大规模 AI 训练和推理任务。其高达 28.8 Tbps 的网络带宽和低延迟的 GPU 到 GPU 通信,使得数据处理更加高效,能够满足复杂模型的需求。
灵活的配置选择
用户可以根据需求选择不同的配置,EC2 P6e-GB200 UltraServers 提供 36 至 72 个 GPU 的多种选择。这种灵活性使得用户能够根据具体的计算和内存需求,优化资源使用,降低成本。
与 AWS 服务的集成
EC2 P6e-GB200 UltraServers 可以与多种 AWS 托管服务无缝集成,用户可以利用 AWS 的生态系统来构建和部署 AI 应用。这种集成能力为开发者提供了更多的工具和资源,提升了开发效率。
预订和使用注意事项
在达拉斯本地扩展区使用 EC2 P6e-GB200 UltraServers 时,用户需提前预订容量块并支付费用。成功预订后,用户可以通过 AWS 管理控制台等工具运行实例,确保在需要时能够及时获得计算资源。
延伸问答
Amazon EC2 P6e-GB200 UltraServers 的主要特点是什么?
该服务器搭载 NVIDIA GB200 NVL72 加速器,支持多达 72 个 GPU,提供高达 28.8 Tbps 的网络带宽,适合大规模 AI 训练和推理任务。
EC2 P6e-GB200 UltraServers 适合哪些类型的工作负载?
适合计算和内存密集型 AI 工作负载,如训练和推理前沿模型,包括混合专家模型和推理模型。
如何预订 EC2 P6e-GB200 UltraServers 的容量块?
用户可以在 Amazon EC2 控制台选择容量预留,购买适用于 ML 的容量块,并指定需要的时长。
EC2 P6e-GB200 UltraServers 的计算能力如何?
在一个 NVLink 域内使用多达 72 个 NVIDIA Blackwell GPU,获得 360 千亿次浮点运算的 FP8 计算能力。
EC2 P6e-GB200 UltraServers 如何与其他 AWS 服务集成?
该服务器可以与各种 AWS 托管服务无缝集成,支持用户构建智能代理式和生成式人工智能应用程序。
NVIDIA Grace Blackwell 超级芯片的特点是什么?
采用 NVLink-C2C 互连技术,提供 10 千亿次浮点运算的 FP8 计算能力和高达 372 GB 的 HBM3e 内存。