Meta推出MTIA 300训练芯片,内置网络接口和通信卸载引擎,专为推荐模型优化。通过集成NIC和专用消息引擎,通信不占用计算资源,性能比GPU快3.9倍。HCCL库协同设计,实现高效集体通信,支持大规模模型训练,并为未来AI工作负载奠定基础。
本文介绍了Meta公司的第二代MTIA加速器,讨论了其协同设计过程和模型架构,展示了性能、效率和开发者体验,强调了利用特殊硅片功能加速Meta模型的示例。
Meta推出的新一代AI芯片MTIA,专为数据中心设计,性能是第一代的三倍,具备256MB内存和1.3GHz频率,能够更快地训练推荐模型。Meta计划将其应用于生成性AI模型,随着AI需求增长,定制芯片竞争加剧。
完成下面两步后,将自动完成登录并继续当前操作。