MiniMax H3现已上线AI Gateway

MiniMax H3现已上线AI Gateway

💡 原文英文,约300词,阅读约需2分钟。
📝

内容提要

MiniMax H3模型已在AI Gateway上线,支持从文本、起始图像、首尾帧或参考素材生成2K视频,时长5至15秒,提供多种宽高比。用户可通过AI SDK设置模型参数,实现文本转视频、图像动画化及参考素材引导生成,并支持在提示中引用多个参考内容。

🔎

延伸解读

多模态参考输入

MiniMax H3支持文本、起始图像、首尾帧以及参考素材(图像、视频或音频)作为输入,且参考模式与关键帧模式互斥。这意味着用户可以在一次请求中结合多种模态来引导视频生成,例如用参考图像保持主体一致性,同时用文本描述场景变化。这种灵活性为创意控制提供了更多可能,但需注意不同输入模式之间的兼容性限制。

输出规格与适配

模型输出为2K分辨率的MP4视频,时长5至15秒,支持多种宽高比(如21:9、16:9、4:3、1:1、3:4、9:16),并可自适应输入图像的宽高比。这为不同平台(如横屏、竖屏)的内容创作提供了便利,但用户需根据目标平台选择合适的时长和比例,以优化观看体验。

集成与使用方式

通过AI SDK,开发者可以轻松集成MiniMax H3,只需设置模型为'minimax/minimax-h3'并传入提示词、宽高比、时长等参数。示例代码展示了文本转视频、图像动画化及参考素材引导的用法,并支持通过providerOptions调整轮询超时时间。这降低了视频生成功能的开发门槛,但实际效果可能受网络延迟和模型响应时间影响。

Q&A

MiniMax H3 模型在 AI Gateway 上支持哪些视频生成方式?

MiniMax H3 支持从文本提示、起始图像、首尾帧对或参考素材(图像、视频或音频)生成视频。具体包括文本转视频、首帧图像转视频、首尾关键帧转换以及多模态参考转视频。

MiniMax H3 生成的视频有哪些规格?

输出为 MP4 格式,分辨率为 2K,时长 5 到 15 秒,支持多种宽高比,包括 21:9、16:9、4:3、1:1、3:4、9:16,或根据提供的图像自适应。

如何在 AI SDK 中使用 MiniMax H3 进行文本转视频?

在 AI SDK 中,将模型设置为 'minimax/minimax-h3',调用 experimental_generateVideo 函数,传入 prompt 文本、aspectRatio 和 duration 等参数即可。例如:generateVideo({ model: 'minimax/minimax-h3', prompt: 'A white kitten chases a butterfly across a sunlit garden.', aspectRatio: '16:9', duration: 5 })

MiniMax H3 如何实现图像动画化?

将起始图像作为 prompt 的 image 字段传入,并附上文本描述,模型会根据图像的宽高比进行动画化。例如:prompt: { image: firstFrameUrl, text: 'The camera slowly pulls back to reveal the full landscape.' }

MiniMax H3 如何使用参考素材引导视频生成?

通过 inputReferences 参数传入参考图像、视频或音频,并在 prompt 中按顺序引用它们,例如 'Keep the subject from Image 1 consistent while they walk through a sunlit garden.'。注意参考模式和关键帧模式是互斥的。

MiniMax H3 的首尾帧转换功能是什么?

首尾帧转换是指模型可以根据一对首帧和尾帧图像生成视频,实现从起始画面到结束画面的过渡。该功能与参考模式互斥。

🏷️

标签

➡️

继续阅读