图形学宗师童欣加盟Meshy,要做“AI for Fun”的头号玩家

图形学宗师童欣加盟Meshy,要做“AI for Fun”的头号玩家

💡 原文中文,约4500字,阅读约需11分钟。
📝

内容提要

图形学专家童欣加入胡渊鸣创办的AI 3D公司Meshy任首席科学家。童欣曾在微软亚洲研究院工作25年,论文引用超2.1万次。Meshy致力于用AI将文字图片转为3D模型,估值超百亿元。双方将共同推进多模态世界模型与实时交互系统突破,探索用AI重塑图形学、实现“AI for Fun”的愿景。

🔎

延伸解读

童欣加盟Meshy:学术与产业的双向奔赴

童欣在微软亚洲研究院工作25年,是图形学领域的资深学者,其Google Scholar引用超过2.1万次。他的加入为Meshy带来了深厚的学术积累和前沿视野。Meshy作为AI 3D领域的明星公司,估值超百亿元,拥有1200万用户。双方合作有望推动多模态世界模型与实时交互系统的突破,加速AI 3D技术的落地。

AI for Fun:Meshy的愿景与挑战

Meshy创始人胡渊鸣提出“AI for Fun”愿景,旨在用AI为人类带来快乐和意义感。他认为,当AGI解决生产力问题后,人类将追求更有效的快乐生成方式。Meshy正从三个层面推进:重新发明图形学、搭建导演系统、构建基础设施。然而,这一愿景面临技术挑战,如可控性、实时性等,需要长期投入和突破。

Mora架构:超越世界模型的尝试

Meshy团队发布Mora(多模态开放世界实时架构),由Coding agent、3D生成和视频模型三部分组成。胡渊鸣称其“超越世界模型”,旨在解决现有互动视频模型的弊端,如一致性弱、物理解算能力弱等。Mora通过分工协作,让Coding agent搭骨架、Meshy生成3D、视频模型出画面,以提升空间稳定性和可玩性。目前Mora仍处于早期验证阶段。

三维与视频生成:互补而非替代

童欣曾提出“三维是否只是视频生成的特例?”这一问题。Mora架构给出了初步回答:两者不必是替代关系,可以在Coding agent的串联下各司其职。视频模型擅长渲染,但缺乏3D空间一致性;而3D生成能提供稳定结构。这种互补思路为AI 3D的发展提供了新方向,但答案尚未确切,仍需进一步探索。

Q&A

童欣加入Meshy担任什么职位?

童欣正式加入Meshy,出任首席科学家,负责制定Meshy的长期科研战略。

Meshy是一家什么样的公司?

Meshy是由胡渊鸣创办的AI 3D公司,致力于用AI将文字和图片转化为3D模型。目前拥有1200万用户,客户覆盖全球市值与估值前十企业中的半数,估值超100亿元人民币。

童欣在图形学领域有哪些主要成就?

童欣在微软亚洲研究院工作25年,领导网络图形组并担任全球研究合伙人。其Google Scholar引用超过21000次,研究方向涵盖材质捕捉与建模、纹理合成、三维几何处理、光传输分析与模拟、真实感绘制、三维人脸动画等。

胡渊鸣提出的“AI for Fun”愿景是什么?

胡渊鸣认为,当AGI解决大量生产力问题后,人类将追求更新颖、更有效的快乐和意义感生成方式,而这种方式将由AI驱动。因此,用AI给人类带来快乐和意义感,将是未来五年最重要的问题之一。Meshy希望成为这一图景中的关键拼图。

Meshy目前正在哪些层面进行基础性技术研究?

Meshy正在三个层面做基础性技术研究:一是重新发明图形学,用AI打造不依赖“三角形”的全局最优解;二是搭建导演系统,负责制定世界运行机制和3D骨架,实现剧本实时编写;三是构建低延迟、高画质、低成本的三维生成与渲染基础设施。

Mora是什么?它如何超越世界模型?

Mora是“Multimodal Open-world Real-time Architecture”的缩写,意为多模态开放世界实时架构。它由Coding agent生成游戏世界骨架和运行代码、3D生成丰富骨架并输出控制信号、视频模型接收3D场景信号输出最终画面与音效三部分组成。胡渊鸣称其为“超越世界模型”的技术,因为现有视频模型本质只是渲染器,而Mora让各模块各司其职,实现空间稳定、精致且可玩。

🏷️

标签

➡️

继续阅读