Seedance 2.5现已在Vercel AI Gateway上线

Seedance 2.5现已在Vercel AI Gateway上线

💡 原文英文,约400词,阅读约需2分钟。
📝

内容提要

字节跳动Seedance 2.5现已在AI Gateway上线,可生成最长30秒视频,支持镜头运动与连续性,无需后期拼接。支持文本、视频、图像和音频输入,可编辑已生成视频,支持十多种语言提示。提供代码示例展示视频生成、图像引用和视频编辑功能。

🔎

延伸解读

多模态输入与参考分离

Seedance 2.5支持在同一请求中混合文本、视频、图像和音频输入,并允许从不同素材分别提取外观与运动。例如,可从一张图取角色外观,从另一段视频取镜头运动。这种设计让创作者能灵活组合素材,但文章也提醒,混合参考与编辑功能时结果可能不稳定,需明确每个素材的用途。

本地编辑与多版本生成

该模型支持对已生成视频进行本地编辑,如替换背景、产品或角色,同时保持画面、镜头和节奏不变。这意味着一个原始片段可以快速衍生出多个版本,适合广告或内容创作中需要批量变体的场景。但文章未提及编辑的具体操作方式或限制,实际效果需通过API测试验证。

API集成与代码示例

文章提供了通过AI SDK调用Seedance 2.5的代码示例,包括视频生成、图像引用和视频编辑。开发者可设置模型为'bytedance/seedance-2.5',并指定分辨率、时长等参数。示例中展示了如何通过inputReferences传递图像或视频URL,并在提示词中引用[Image 1]或[Video 1]。这降低了集成门槛,但实际使用中需注意API的稳定性与成本。

Q&A

Seedance 2.5 是什么?它有哪些主要功能?

Seedance 2.5 是字节跳动推出的视频生成模型,现已在 Vercel AI Gateway 上线。它支持生成最长 30 秒的单段视频,保持镜头运动和连续性,无需后期拼接。支持文本、视频、图像和音频作为输入,可编辑已生成的视频,并支持十多种语言的提示。

Seedance 2.5 能生成多长的视频?

Seedance 2.5 可以生成最长 30 秒的单段视频,并且可以保持镜头运动和连续性,无需后期拼接。

Seedance 2.5 支持哪些输入类型?

Seedance 2.5 支持文本、视频、图像和音频作为输入,可以在同一个请求中组合使用,例如从一张图片获取外观,从另一个视频获取运动或镜头运动。

如何使用 Seedance 2.5 生成视频?

使用 AI SDK 调用 generateVideo 函数,设置模型为 'bytedance/seedance-2.5',提供提示词、分辨率、时长等参数,即可生成视频。例如:generateVideo({ model: 'bytedance/seedance-2.5', prompt: 'A chicken flying into the sunset in the style of 90s anime', resolution: '1920x1080', duration: 30 })。

Seedance 2.5 如何引用图片来生成视频?

在 generateVideo 调用中,通过 inputReferences 传入图片 URL,并在提示词中使用 [Image 1]、[Image 2] 等占位符来引用。例如:prompt: 'A boy from [Image 1] walking a corgi from [Image 2] through the park at sunset'。

Seedance 2.5 的视频编辑功能是如何工作的?

Seedance 2.5 可以对已生成的视频进行局部编辑,例如替换背景、产品或角色,同时保持画面、镜头和节奏不变。在 API 中,可以通过 inputReferences 传入视频和图片,并在提示词中指定如何组合,例如 'Follow the camera movement and pacing of [Video 1], with the product from [Image 1]'。

Seedance 2.5 支持哪些语言?

Seedance 2.5 的提示词支持十多种语言。

🏷️

标签

➡️

继续阅读