数美科技携手形界智能,共建AI实时视频生成新生态

数美科技携手形界智能,共建AI实时视频生成新生态

💡 原文中文,约2200字,阅读约需6分钟。
📝

内容提要

形界智能发布Genesis1.0,探索实时互动视频生成,使视频从一次性生成变为持续理解并回应用户的互动世界。其Era系列模型覆盖虚拟人、AI陪伴、体感交互等场景,通过理解与生成同一模型降低延迟。安全方面,形界与数美科技合作,将实时围栏融入生成链路,坚持安全优先,兼顾交互体验。

🔎

延伸解读

实时视频生成的技术路线:理解与生成一体化

形界智能的Genesis和Rise模型采用将视频理解与生成放入同一模型架构的技术路线。相比先由独立理解模型识别用户状态再转换为生成指令的方案,这种一体化设计减少了中间转换环节,从而降低交互延迟,让理解、生成与反馈发生在更紧密的链路中。王裕鑫指出,响应速度直接影响互动能否持续,而用户对类人感有天然诉求,因此该路线旨在提升实时互动的自然度和连续性。

实时互动场景下的安全挑战与应对

当视频从生成后观看变为边生成、边交互、边触达,安全判断需要在毫秒级时间内完成,这对响应速度提出更高要求。同时,用户语音、摄像头画面等持续输入,模型不断生成新内容,安全治理需适应动态多样的内容形态。形界智能与数美科技合作,通过动态评测提前发现风险,依托实时围栏持续识别并处置风险,构建从风险发现到运行防护的闭环,在保障安全的同时尽量降低对交互体验的影响。

安全优先原则下的平衡策略

王裕鑫明确表示“安全一定优先”,可以通过链路优化减少对用户体验的影响,但安全是最重要的。双方将实时围栏融入生成链路,坚持安全优先,兼顾交互体验。对于更进一步的安全治理,他认为首先要把控用户最终获得的内容,再向前分析风险来源,判断问题来自用户输入还是模型自身的控制能力。这种思路有助于在实时互动中实现精准风险处置。

应用场景与生态开放方向

形界智能的Era系列模型覆盖虚拟人直播、AI陪伴、互动娱乐、体感交互等场景。Genesis-1.0作为面向开发者的长时、智能AI互动娱乐基础设施,支持24小时稳定在线,并通过摄像头实时感知用户,实现聆听、思考、反馈、表达的类人行为闭环。Rise-V0.2则拓展至开放场景和体感交互,用户无需复杂指令或传统控制器即可模拟方向盘等操作。未来,形界智能将更专注模型能力,持续优化架构和数据利用效率,并将模型开放给更多互动内容开发者使用。

Q&A

形界智能发布的Genesis1.0是什么?

Genesis1.0是形界智能于9月20日正式发布的实时互动视频生成模型,作为面向开发者的长时、智能AI互动娱乐基础设施,基于全新的视频双工范式,在生成时长、响应速度与应用成本上达到业内领先的Interactive Avatar水准。

形界智能的Era系列模型覆盖哪些应用场景?

Era系列模型覆盖虚拟人直播、AI陪伴、互动娱乐、体感交互和开放场景等。其中Genesis探索虚拟人直播、AI陪伴、互动娱乐等场景,Rise将实时生成进一步拓展至体感交互和开放场景。

形界智能如何降低实时视频生成的交互延迟?

形界智能将视频理解与生成放入同一模型架构,让理解和生成发生在同一个模型中,从而降低交互延迟,使理解、生成与反馈发生在更紧密的链路中。

实时视频生成面临哪些安全挑战?

实时视频由模型持续接收用户输入并生成内容,视频和语音快速触达用户,安全判断需要在毫秒级时间内完成;同时内容形态更加丰富,用户语音、摄像头画面等信息持续进入模型,安全治理需要适应动态、多样的内容形态。

形界智能与数美科技在安全方面如何合作?

双方通过动态评测提前发现风险,依托实时围栏持续识别并处置风险,构建从风险发现到运行防护的安全治理闭环,围绕虚拟直播、AI陪伴等实时互动场景持续探索,在保障内容安全的同时尽量降低对实时交互体验的影响。

形界智能如何处理安全与用户体验的平衡?

王裕鑫态度明确:安全一定优先。可以通过链路优化减少对用户体验的影响,但安全是最重要的。

🏷️

标签

➡️

继续阅读