字节的 Seed-Audio 音频生成模型能力强、可控性高,但官方资料少且冷门。作者为此开发开源 Skill,采用 7 步工作流,将故事目标分解并生成多段音频,面向短剧、漫剧等故事性创作。使用需配置 SEED_AUDIO_API_KEY 并安装 ffmpeg。核心难点是构造统一的复合音频 prompt,作者还从豆包官方 Skill 中提取提示词技巧并整理成文档。
完成下面两步后,将自动完成登录并继续当前操作。