Anthropic的Claude模型现已在微软Azure上运行,利用NVIDIA GB300 Blackwell Ultra GPU,企业可以构建自主和特定领域的AI代理。这一合作增强了开发者的能力,使AI代理能够深度嵌入业务中,提升效率并降低成本。
英伟达创始人黄仁勋亲自将首台DGX Station(GB300)赠予个人开发者卡帕西,标志着个人开发者在AI时代的重要性。卡帕西致力于将AI系统简化为个人可操作的工具,推动智能体的发展,体现了算力向个人开发者的转变。
DeepSeek-V3.2在GB300上成功运行,使用FP4量化在预填充场景中实现7360 TGS的吞吐量。与DeepSeek-R1相比,V3.2在推理性能上仍有提升空间。B300系列在预填充和混合场景中表现出显著性能提升,尽管V3.2引入了新索引器,但预填充阶段的吞吐量仍低于R1,未来有优化潜力。
SuperX AI Technology Limited推出的SuperX GB300 NVL72系统,基于NVIDIA GB300超级芯片,提供高达1.8 exaFLOPS的AI性能,突破了大模型训练与部署的算力极限,采用72颗GPU和36颗CPU,重新定义AI计算标准。
英伟达GB300 AI芯片将使用三星HBM3E,黄仁勋表示美国在AI发展上未领先中国。阿斯麦任命新CTO,英特尔推出18A PC芯片。Sora下载量超越ChatGPT,谷歌云发布Gemini Enterprise,阿里云与NBA中国达成合作。预计PC DRAM价格将上涨。
微软Azure推出NDv6 GB300虚拟机系列,搭载NVIDIA GB300 NVL72系统,专为OpenAI的AI推理工作负载设计,集群拥有4600多块GPU,提升推理和训练能力,巩固美国在AI领域的领导地位。
NVIDIA GB300 NVL72系统在推理基准测试中表现优异,提升了AI工厂的吞吐量并降低了总拥有成本。新架构Blackwell Ultra提供更强的计算能力和内存,优化大型语言模型推理,显著提升性能。
伟创力在OCP亚太峰会上推出新电源架系统,支持800伏直流电力架构,满足AI基础设施需求。该系统为NVIDIA GB300 NVL72平台提供高能效,具备高密度直流配电,支持1兆瓦IT机架部署,电能转换损耗降低超过60%。
CoreWeave成为首个部署NVIDIA GB300 NVL72系统的AI云服务商,计划全球扩展。该系统在推理性能上提升显著,响应速度提高10倍,吞吐量提升5倍。CoreWeave与戴尔等合作,整合云原生软件栈,增强数据集群监控。
Nvidia宣布推出新AI GPU Blackwell Ultra,预计今年下半年发货,提供20 petaflops的AI性能和288GB内存。未来还将推出Vera Rubin和Rubin Ultra,性能将显著提升。Nvidia指出,未来计算需求将大幅增加,预计2028年推出新架构Feynman。
英伟达推出B300和GB300芯片,算力和显存提升50%。B300系列显存从192GB升级至288GB,适合OpenAI推理大模型,显著提高处理效率。同时,RTX5090显卡曝光,预计支持32GB显存和8K游戏。
完成下面两步后,将自动完成登录并继续当前操作。