xAI的Colossus集群拥有55万块GPU,但模型浮点运算利用率仅约11%,远低于行业35%至45%的水平。为此,xAI放弃JAX和PyTorch,改用C++和CUDA重写训练栈,并大量使用内联PTX直接控制GPU以逼近裸金属性能。Grok 4.8参数达2.5万亿,训练成本极高。更关键的是,xAI正让较弱模型参与编写训练更强模型的代码,形成递归自我改进循环,但AI生成代码的正确性验证仍是巨大风险。
红杉合伙人认为xAI将胜出:创始团队离职并非崩溃,而是马斯克优先级切换。算力瓶颈已清除,Colossus 2成为全球首个吉瓦级AI集群,等效约140万块H100。下一步重心转向模型与产品,真正赌注是太空数据中心,靠Starship降本。SpaceX已收购xAI,但AI基建烧钱远超Starlink现金流,成败取决于两条曲线何时交叉。
Anthropic与SpaceX达成合作,获得Colossus 1数据中心的计算能力,计划提升Claude Pro和Claude Max用户的使用限制。这将使开发者更高效地使用Claude Code,减少使用瓶颈。此外,Anthropic还与亚马逊、谷歌等公司达成多项协议,显示其在计算能力上的持续扩张,支持未来的增长和长期发展。
BigQuery是Google云平台的无服务器数据仓库,利用Dremel技术进行高效数据分析。Dremel通过列式存储和树结构优化查询,减少MapReduce操作。Capacitor提升了列式数据压缩效率。Colossus支持大规模数据管理,Borg负责集群管理,Jupiter网络提供强大带宽。这些技术有助于优化BigQuery的使用。
完成下面两步后,将自动完成登录并继续当前操作。