2026中国算力大会上,太初元碁新一代超智融合计算系统元碁HyperIntelliX入选“算力中国·年度卓越成就”。公司展出分布式算力解决方案,首次线下展出20英尺集装箱算力单元,预制化率超90%,24小时内可部署,效率提升70%,并展示国产AI4S计算平台等全栈算力方案,适配万亿参数大模型与科学计算。
9月9日,墨芯人工智能在2026外滩大会展示以专用稀疏推理芯片提升算力效能的技术路径。针对推理需求增长,墨芯通过算法、软件、硬件协同优化减少冗余计算,其推理集群已部署于四大片区数据中心,服务智能制造等场景。公司即将推出新一代SparsePrime计算卡,并参与行业标准研制、发起稀疏计算产学研联盟,共建AI算力生态。
文章以对话形式探讨指标问题:作者承认混淆了测量误差与统计差异,二者实为并列关系。讨论设置门槛与排序的公平性,指出指标由谁定、定多少难以回答。并以数据拟合类比:为求稳定规律需剔除误差过大的数据,但会牺牲信息,且受算力与过拟合限制;未来算力提升或可纳入更多数据。
Mistral完成3亿欧元D轮融资,估值超210亿欧元,将扩展前沿研究、算力与基础设施。其战略是构建覆盖开源模型、算力、基础设施及产品的全栈,让客户摆脱对单一供应商的依赖,并回应了Anthropic CEO Amodei关于开源权重只是转移算力集中的质疑。
AI产业竞争正从算力规模转向产能效率,Token工厂将算力转化为可计量的Token产出。四川雅安“天绛·白泽Token工厂”已上线,目标月产能10万亿词元。Gitee AI(模力方舟)作为应用侧大模型平台,提供Serverless API、私有化部署与智算一体机,与Token工厂形成互补而非替代关系。
9月9日,京东全球科技探索者大会在北京举行,主题为“JoyAI·跃迁物理世界”。京东宣布建设国产十万卡算力集群、推进1000万小时具身数据采集,发布JoyAI系列世界模型及AI购物助手“东东”,并启动“物理AI加速计划”,目标在具身智能领域实现六项全球第一。
太初元碁在外滩大会展示国产AI4S计算平台及台风追踪系统,覆盖气象、生物医药等科研领域,基于自研芯片全栈适配主流CPU与框架。平台已与高校企业合作落地,并招聘研发人才,推动国产算力生态发展。
深度智控完成B+轮数亿元融资,由宁德时代领投,多家机构跟投。公司专注物理AI在能源领域落地,构建PhyAI引擎,实现可解释、高可靠的闭环控制,服务数百家客户。融资将深化能源与算力基础设施协同,推动AI从数字走向物理世界。
摩尔线程发布开源高性能算子库MATE,面向生成式AI大模型训练与推理,提供Attention、GEMM、MoE等核心算子,兼容FlashAttention、DeepGEMM等开源生态,并已落地vLLM与SGLang框架。MATE通过多后端优化和JIT编译提升性能,实测单卡吞吐量达国际高端GPU的40%以上,旨在降低开发者迁移成本,推动国产AI算力生态发展。
趋境科技与摩尔线程达成战略合作,基于国产PD异构技术与MTT S5000智算卡,共建高品质AI Token工厂。方案已投产,性价比超越国际算力,实现超50 TPS生成速度、99.9%稳定性。双方将推广Token Pod方案,推动国产算力规模化落地。
OpenAI因马斯克旗下公司违约,切断Cursor对其模型的访问。Anthropic却公开支持Cursor,因其依赖SpaceX的算力,形成竞争与依赖并存的复杂关系。
范式创始人戴文渊与华为达成昇腾950芯片算力战略合作,成为首批采用国产高端算力的AI企业,旨在应对境外算力不确定性,增强金融、政务等大客户交付能力,打破单一算力依赖,采购规模将支撑未来数年营收增长。
优化Qwen 3.8 27B模型时发现,这类重思考的稠密模型适合算力舱(2070T),Prefill速度达3500-4000 TPS,因模型70%-80%时间在思考,Prefill性能关键。Mac Studio虽显存带宽大,但Prefill能力弱,不适合重思考模型,更适合轻思考模型。选硬件需匹配模型推理范式。
文章介绍了通过两台协同计算优化AI模型,实现稳定70 TPS和382K上下文,并利用DFlash2优化稠密模型达到单流125-133 TPS、8并发231 TPS,通过YaRN技术将上下文扩展至900K。同时对比了n-gram和MTP方案,最终选择MTP实现60 TPS和2232 TPS Prefill,适合日常写代码,并计划继续优化其他模型。
商汤大装置与智象未来合作,成功实现国产算力支持视频生成规模化应用。通过LightX2V多卡并行优化,加速比达93%,并解决多卡效果一致性问题。构建统一硬件抽象体系,支持10余种异构芯片零成本迁移,配合FDE专家服务,实现从适配到生产的完整闭环,推动国产算力从“能用”迈向“好用”。
智谱发布并开源GLM-5.3-Flash多模态模型,性能超GLM-5.2,与Claude Opus 4.8持平。商汤大装置提供国产算力支持,通过异构混推技术提升服务性能3倍,成本与英伟达GPU相当,推动国产算力规模化商用,日均Token服务量达2.42万亿。
苹果发布M6芯片,用于新款Mac Mini,采用2nm工艺,12核CPU和12核GPU,性能较M5提升,支持32GB内存。同时推出M5 Ultra,号称最强芯片,用于Mac Studio,配备36核CPU、80核GPU和512GB内存,支持3D渲染和AI模型。两款产品9月22日发售。
SpaceX与英伟达合作设计太空高性能算力系统“Starmind AI”,集成Vera Rubin NVL72,针对太空辐射和温度优化,支持在轨AI推理训练。首批卫星2027年发射,2028年大规模部署,旨在构建全球智能太空算力网络,为通信、遥感和深空探索提供支持。
Darkbloom网络允许用户出租闲置Mac算力运行AI推理,宣称月入120-200美元,但实际收益远低于预期,顶尖节点日收入不足6美元。项目利用苹果安全芯片保护隐私,但需安装MDM文件引发争议。目前仅250台Mac在线,供给过剩、需求不足,多数节点难以盈利,收益分配和去中心化架构存疑。
太初元碁发布分布式算力解决方案,以预制化集装箱算力单元为核心,推出风冷智算、液冷超节点及超节点集群三类产品,工厂预制率超90%,24小时投运,支持绿电接入和户外部署。方案配套算力管理平台,已在气象、生物医药等领域落地,并展示多款国产算力产品。
完成下面两步后,将自动完成登录并继续当前操作。