NVIDIA推出BioNeMo推理运行时,通过内核选择、CUDA Graph和Ray流水线优化蛋白结构预测。在8张H100上,Boltz-2吞吐达每GPU小时5.85万残基,较公开实现提升2.9倍。文章强调科学AI吞吐应以成功结构数和完整流程时间衡量,需关注CPU预处理、写盘和失败率等瓶颈。
完成下面两步后,将自动完成登录并继续当前操作。