高德发布2026版扫街榜,全面AI化,利用空间智能理解用户到店行为,让宝藏好店脱颖而出。其核心引擎ABot-Earth 0.7是全球首个3D原生城市世界模型,仅凭一张卫星图或文字,10分钟即可生成逼真3D城市,效率提升千倍,已覆盖190多国、300多城。高德借此从导航工具升级为连接机器人与物理世界的空间智能基础设施。
9月10日,高德发布全球首个3D原生城市世界模型ABot-Earth 0.7,支持从星球到街景的全尺寸AI生成,覆盖196个国家和地区。输入卫星图或文字,10分钟即可在消费级GPU生成公里级3D城市场景,效率提升千倍。用户可自由探索、实时交互,已应用于飞行街景2.0。高德称其空间智能分三维表达、动态感知、时空推演三层,将向全行业开放。
AI虽擅长语言理解,却缺乏对物理世界的认知与决策能力,难以应对暴雨洪水等真实灾害。飞渡科技推出空间智能“峥嵘大模型”,构建全栈基础设施,通过动态边界控制、1:1验证和智能体调度,实现洪水推演与决策,将响应从经验驱动转为模型驱动,并获HICOOL一等奖,标志世界模型从生成迈向实用决策。
World Labs发布Atlas,可从照片或视频生成3D场景,用于机器人导航等。但作者关注工程落地挑战:重建精度、成本、可观测性及数据闭环。提醒开发者,空间智能将成新输入类型,需提前规划存储、任务管理和失败回放等基础设施,避免模型演示与系统落地脱节。
fable51-worlds项目利用AI智能体集群,在数天内将旧金山街区数据转化为可交互三维场景,替代了传统数千小时的人工建模。该项目通过Claude Fable 5.1调度研究、建模、质检智能体,成本极低,并成功处理NASA数据生成金星地形图,展示了通用空间智能引擎自动生成可交互世界的能力。
World Labs发布3D世界模型Atlas,仅需3-5台手机或相机即可生成“子弹时间”效果,替代传统60台相机阵列。它融合文字、图像、深度和相机位姿,构建三维空间,支持后期自由调整机位、生成新视角,甚至重建场景为点云或Gaussian Splat。该技术旨在推动空间智能,降低机器人训练成本,让创作摆脱设备限制。
李飞飞的文章探讨了“世界模型”的概念,指出其定义混乱,行业需重新梳理。文章将世界模型分为渲染器、模拟器和规划器三类,强调模拟器在连接视觉与行动中的重要性。三者的融合将推动空间智能的发展,使机器不仅能理解世界,还能参与其中。
中国图像图形大会(CCIG 2026)将于2026年5月29日至31日在广州举行,主题为“图绘湾区,象启新元”。大会将聚集4000余名专家,讨论图像图形技术在智能时代的应用与发展,重点关注多模态视觉与空间智能,以及AI在理解空间与真实世界中的最新突破。多位院士和专家将发表主旨报告,展示前沿技术与应用。
李飞飞团队发布了ESI-Bench,这是一个用于评测具身空间智能的新基准。该基准要求AI主动探索以获取信息,研究显示当前AI在空间智能方面,尤其是主动探索和推理能力上仍存在不足。ESI-Bench包含3081个任务实例,覆盖人类核心空间认知能力,旨在提升AI的空间推理能力。
群核科技近日在港股上市,股价大幅上涨。公司专注于空间智能,致力于让AI理解和重建物理世界。其技术积累了大量三维数据,推动AI从文本理解向空间理解转变。群核的空间语言模型和生成模型已取得显著成果,未来将助力机器人等领域的发展,空间智能被视为AI的基础设施,具有广阔的应用前景。
Niantic Spatial推出了Scaniverse,为企业提供空间智能服务。该软件利用3D扫描、卫星图像和GPS数据创建精确的地理模型,帮助机器理解物理环境。Scaniverse支持多设备捕捉,生成可供机器人导航的空间地图,推动地理空间AI的发展。
京东开源的多模态基础模型JoyAI-Image-Edit支持文生图、图像理解和指令引导的图像编辑,具备像素级精细化编辑和空间智能,解决了理解与生成之间的“空间断层”。该模型在电商、具身智能和3D重建等领域表现出色,提升了创意验证效率。
李飞飞创办的World Labs获得10亿美元融资,估值达50亿美元。该公司专注于“空间智能”和“世界模型”,吸引了AMD、英伟达等投资者。李飞飞指出,空间智能是AI的下一个前沿,旨在让AI理解并参与物理世界。
商汤科技开源的SenseNova-SI-1.3在空间智能任务中表现优异,综合评分超过Gemini-3-Pro,尤其在视角转换等高难度任务中展现出更高的准确性。该模型通过重组多视角数据,提升了空间理解能力,克服了传统模型的不足。
字节跳动的Depth Anything 3(DA3)模型通过单一Transformer实现深度和姿态估计,简化了三维视觉任务的处理,并刷新了多项基准测试记录。
商汤科技的SenseNova-SI模型在空间智能领域超越了李飞飞团队的Cambrian-S,标志着AI技术的转变。林达华指出,未来AI应从语言模型转向多模态理解,以更好地理解物理世界。商汤通过原生多模态架构NEO,实现了数据效率提升和空间智能的突破,推动了AI的实际应用。
李飞飞博士是斯坦福大学计算机科学系的红杉教授和人本人工智能研究所的共同创始人,曾任谷歌AI/ML首席科学家。她的成长经历从中国成都到美国新泽西,父母的支持激发了她的科学热情。她创建的ImageNet数据集推动了现代AI的发展,强调了大数据的重要性。目前,她在World Labs专注于空间智能,推动AI技术的应用与发展。
微软亚洲研究院启动“铸星计划”,邀请全球青年学者进行为期三个月的研究,聚焦空间智能与具身AI,旨在推动AI在三维环境中的应用与发展,促进学术与产业合作。
空间智能是人工智能的下一个前沿,李飞飞指出其核心能力包括生成、交互和多模态处理。通过构建世界模型,AI将更好地理解和创造现实与虚拟世界,推动各领域的创新与发展。
李飞飞认为空间智能是未来十年的重要挑战。她联合创办的World Labs推出了Marble,用户可以通过文本、图像或视频生成3D世界。该产品提供四个订阅层级,支持快速构建和编辑3D环境,可能会改变故事叙述、建筑和科学发现等领域。
完成下面两步后,将自动完成登录并继续当前操作。