商汤大装置针对Token需求爆发,以“Token、状态与时延预算”为核心设计推理系统,日均Token服务量从2月的0.46万亿增长至8月的4.5万亿。通过横向编排统一异构算力、纵向优化模型引擎与芯片,并推进动态资源池和模块级资源池演进,提升吞吐并降低成本。
沙利文报告显示,商汤大装置以近50%份额位居中国Neocloud市场第一。报告称2026年为Agentic AI元年,算力需求将提升十倍以上,Neocloud价值凸显。商汤具备端到端系统化、超大规模集群稳定运行、算电协同、国产算力生态及Token服务等优势,日均Token服务量达4.5万亿,并联合伙伴发起“银河计划”共建国产AI基础设施生态。
商汤大装置与智象未来合作,成功实现国产算力支持视频生成规模化应用。通过LightX2V多卡并行优化,加速比达93%,并解决多卡效果一致性问题。构建统一硬件抽象体系,支持10余种异构芯片零成本迁移,配合FDE专家服务,实现从适配到生产的完整闭环,推动国产算力从“能用”迈向“好用”。
智谱发布并开源GLM-5.3-Flash多模态模型,性能超GLM-5.2,与Claude Opus 4.8持平。商汤大装置提供国产算力支持,通过异构混推技术提升服务性能3倍,成本与英伟达GPU相当,推动国产算力规模化商用,日均Token服务量达2.42万亿。
商汤大装置在WAIC展示国产算力成果,通过异构混合推理组合高端与国产芯片,算力利用率提升85%-152%,单位成本Token产出提升2.5倍。其端到端整合策略从硬件到电力协同,实现高毛利增长,并计划扩展至太空算力等领域。
完成下面两步后,将自动完成登录并继续当前操作。