Inworld推出对话式文本转语音模型TTS-2,支持开发者用自然语言控制语气、停顿和笑声,并可克隆语音、跨语言使用。实时版TTS-2 Flash首字节响应仅25毫秒,适合高并发低延迟场景。Talkpal测试显示功能使用率提升7%、留存提高4%、成本降低40%。语音模型更新无需重构应用,可按需路由请求。
完成下面两步后,将自动完成登录并继续当前操作。