内容提要
Physical AI公司息壤开物完成数亿元种子轮及天使轮融资,估值达5亿美元。创始人李寅与前华为多模态首席科学家张含望联手打造大物理模型LPM,从海量视频和真实交互中预训练物理基础模型,实现跨本体跨场景通用能力。该模型已在World Arena 2.0榜单取得领先,训练成果XIRRA v0.1计划今年晚些时候亮相。
延伸解读
物理基模的挑战:从离散Token到连续世界
文章指出,LLM处理的是离散Token序列,而物理世界是连续、混沌且充满不确定性的。LPM需要从像素、声音、位置和受力变化中自行找到表征,这比语言建模更难。息壤选择自回归架构,基于马尔可夫过程和贝尔曼递归,将长程决策拆解为状态、动作、下一状态的循环,避免组合爆炸。这种第一性原理的路径,是LPM区别于VLA和传统机器人学习的关键。
团队互补:工程落地与因果理论的结合
李寅带来华为云盘古大模型的训练和产业交付经验,张含望则在因果机器学习、多模态理解上深耕。物理AI不仅需要统计相关性,更要理解动作与结果的因果关系,才能泛化到新场景。两人的组合让息壤同时具备大规模训练、数据管线和产业反馈能力,而非单纯实验室或项目交付公司。这种融合是推进LPM预训练的组织基础。
早期信号与风险:Scaling Law尚待验证
息壤在World Arena 2.0的Trajectory Accuracy和Physical Adherence上取得领先,并观察到随数据与训练规模增加性能初步提升。但这些只是早期信号,物理世界是否存在Scaling Law仍未知。万卡集群月耗上亿元,若缩放效应不持续,路线可能受阻。XIRRA v0.1的亮相将是重要检验点,读者需关注其实际泛化能力和成本控制。
Q&A
息壤开物是一家什么样的公司?
息壤开物是一家Physical AI创业公司,专注于研发大物理模型(LPM),旨在从海量视频和真实交互中预训练物理基础模型,实现跨本体跨场景的通用能力。公司已完成数亿元种子轮及天使轮融资,估值达5亿美元。
什么是大物理模型(LPM)?
LPM(Large Physics Model)是息壤开物提出的物理基础模型,它从海量视频、机器人轨迹和真实交互中预训练,学习物理世界的连续变化和因果关系,从而具备跨本体、跨场景的通用能力,与主要处理离散文本的LLM有本质不同。
息壤开物的核心团队有哪些人?
创始人兼CEO李寅,前华为云大模型CTO、华为大模型0-1阶段核心成员;联合创始人兼首席科学家张含望教授,前华为多模态首席科学家、南洋理工大学教授,在因果机器学习等领域有深厚研究。
息壤开物的LPM目前取得了哪些进展?
息壤的模型在World Arena 2.0 Track 1中,Trajectory Accuracy单项排名第一,Physical Adherence单项排名第二。同时,随着数据与训练规模增加,模型性能已出现初步提升趋势,显示出Scaling effects的潜力。
息壤开物的LPM技术架构是怎样的?
LPM以Unified AR Transformer为骨干,采用自回归架构,将复杂过程拆解为连续的条件预测;Diffusion作为可选模块用于视觉生成。模型分为六个底层能力底座:统一Token、统一模型架构、强化学习算法、数据体系、评测体系和工程基础设施。
息壤开物的产品规划分为哪几个层次?
息壤将模型能力划分为L0、L1和L2三个层次:L0是通用物理基础模型,形成跨任务、跨场景、跨本体的底层能力;L1是领域模型,进入工业制造等具体领域学习行业知识;L2是具体应用,将领域能力转化为可部署的机器人任务。