谷歌发布Gemini实时语音模型,包括3.8 Live和3.8 Live Extended Thinking,支持异步函数调用、视觉上下文、多语言及后台深度推理,在语音对话排行榜居首;3.5 Transcribe支持85种以上语言,流式错误率4.0%。模型按分钟计费,可通过多家集成伙伴部署。
完成下面两步后,将自动完成登录并继续当前操作。