谷歌发布Gemini 3.8 Live与Extended Thinking原生语音模型,支持实时推理和工具调用,无需串联ASR、LLM和TTS。Extended Thinking在语音质量指数以82.6分居首,τ-Voice达68.6%,Big Bench Audio达97.7%。Live API支持异步函数调用、视觉输入和97种语言切换。音频输入每分钟0.005美元,输出0.018美元,音频带SynthID水印。
完成下面两步后,将自动完成登录并继续当前操作。