Deepgram与高通合作,将Nova-3语音识别模型优化至骁龙X系列NPU,实现设备端实时语音转文本,无需云端,降低延迟和隐私风险。该技术适用于汽车、AI PC、XR等场景,提升准确率(词错误率6.89%),支持多语言和定制,为离线语音交互奠定基础。
语音技术正迅速成为人与技术的主要交互方式。IBM与Deepgram的合作将语音转文本和文本转语音功能集成到企业中,提升了语音AI的可靠性和应用范围,推动了企业AI的演进。
IBM与Deepgram合作,将语音转文本和文本转语音功能集成到watsonx Orchestrate中,以满足企业对高性能转录和实时字幕的需求。这使Deepgram成为IBM首个语音合作伙伴,推动了医疗和金融领域的运营自动化和对话式AI技术的发展。
Deepgram利用深度学习提升语音识别和合成能力,解决方言和噪音环境的挑战,并关注语音克隆的伦理问题。该公司致力于构建准确、可扩展且经济实惠的语音AI,推动语音技术的应用。
云通信平台Voximplant宣布支持Deepgram的语音代理API,简化实时语音AI的部署。开发者可在通话中使用语音识别和合成功能,无需管理复杂基础设施,提升了语音AI的可靠性和低延迟,改善客户体验。
Deepgram与Amazon SageMaker AI集成,提供流式实时语音转文本和文本转语音功能,简化AWS环境中的语音应用开发,适用于呼叫中心等场景,确保数据安全与合规性,助力企业创新。
Cloudflare的Workers AI平台新增与Leonardo.Ai和Deepgram的合作模型,支持低延迟图像生成和实时语音代理,提升开发者构建AI应用的能力。
Deepgram与AWS达成战略合作,增强语音AI的整合,帮助企业构建高精度语音应用。此合作将简化AI模型的部署,提高客户体验。
Deepgram 发布了名为 Saga 的语音操作系统,旨在通过语音控制工具和代码来提升开发者的工作效率。Saga 可与多种编码环境和项目管理软件集成,简化开发流程,减少工具间切换,提供更自然的工作体验。
Twilio的call-gpt项目使开发者能够在两小时内构建AI语音助手,结合OpenAI和Deepgram,实现实时通话和自然对话。该项目支持中断、记忆和API调用,提供完整的代码控制,适用于多种应用场景。
Deepgram推出了新一代文本到语音模型Aura-2,专为企业实时语音应用设计,提供清晰、低延迟的语音体验,支持行业术语精准发音,具备多种语音选择,优化企业沟通效率,降低成本。该平台可在云端或本地部署,确保安全性和灵活性。
音频通话质量保证对客户互动企业至关重要。通过Deepgram的语音转文本和Sonnet的智能分析,企业可自动化QA分析,提升客户体验和代理表现。这两种工具结合使用,能更高效地处理通话录音,确保合规性并改善服务质量。
Deepgram于2025年推出了Nova-3语音转文本模型,具备高准确性和自助定制功能,适用于复杂音频环境,支持实时多语言转录,特别适合医疗和法律行业,显著提高转录准确性,降低企业成本,推动语音AI应用发展。
完成下面两步后,将自动完成登录并继续当前操作。