AMD MI355X在运行Kimi K3模型时,凭借更低价格和更高每美元吞吐量,性能超越英伟达B300。通过修复投机解码和预填充内核的软件缺陷,MI355X单节点速度达到B200的3.8倍,首字延迟大幅降低。文章认为,CUDA生态并非不可撼动,硬件性价比和工程师修bug能力正成为新护城河。
DigitalOcean推出DeepSeek V3.2、MiniMax-M2.5和Qwen 3.5 397B,优化了硬件和软件,提升了推理速度和效率,满足现代AI应用的低延迟需求。
DigitalOcean即将推出NVIDIA HGX™ B300加速的GPU Droplets,显著提升AI工作负载的计算能力和效率,支持快速部署,简化设置,帮助开发者专注于代码和模型。
Amazon EC2 P6-B300实例发布,配备NVIDIA Blackwell Ultra GPU,网络带宽提升2倍,GPU内存提升1.5倍,适合大规模AI应用,特别是复杂技术场景,支持万亿参数模型训练。
丹麦DCAI宣布,其超级计算机Gefion将成为欧洲首批部署NVIDIA DGX B300人工智能基础设施的机构,显著提升GPU性能和能效,以满足生成式人工智能和大型语言模型的需求,支持科研与商业客户高效训练和部署AI模型。
在GTC大会上,老黄发布了新AI芯片GB300,其推理性能是GB200的1.5倍,并预览了下一代芯片Vera Rubin。英伟达还推出了DGX Spark和DGX Station两款个人AI超级计算机,支持高效AI运算。同时发布了NVIDIA Dynamo开源库以加速推理,提升性能。大会还探讨了自动驾驶和量子计算等前沿技术。
英伟达推出B300和GB300芯片,算力和显存提升50%。B300系列显存从192GB升级至288GB,适合OpenAI推理大模型,显著提高处理效率。同时,RTX5090显卡曝光,预计支持32GB显存和8K游戏。
完成下面两步后,将自动完成登录并继续当前操作。