谷歌发布Gemini 3.8 Flash TTS与Flash-Lite TTS两款文本转语音模型,通过Gemini API和AI Studio开放。Flash TTS面向创意配音,Flash-Lite面向高并发低成本场景。支持提示词设计音色,覆盖100多种语言,提供2000多个音色,支持声音复刻与SynthID水印。Flash TTS在Hume AI评测中排名第一。
谷歌发布Gemini 3.8 Flash TTS与Flash-Lite TTS两款语音生成模型。前者支持用自然语言从零创建定制音色,逐行控制情感、节奏和口音,覆盖超100种语言;后者面向高并发、低成本场景。模型支持30秒样本复刻声音,并内置同意验证、SynthID水印等安全措施,已在AI Studio、Gemini API等平台上线。
谷歌发布两款Gemini文本转语音模型:3.8 Flash TTS面向创意设计,支持自然语言创建角色声音、100多种语言、逐行表演控制、双人对话及长音频生成;3.8 Flash-Lite TTS面向高性价比大规模配音。两款模型均支持30秒样本声音复刻,并配有同意验证、SynthID水印等安全措施,已在AI Studio等平台推出。
科大讯飞升级语音合成技术,实现声音复刻与超拟人合成,提升相似度与准确度。新技术通过一句话录音精准还原用户声音特征,广泛应用于智能汽车和教育等领域,推动个性化需求发展。
完成下面两步后,将自动完成登录并继续当前操作。