OpenAI发布了首个开源GPT模型(20b和120b),可在Gradient AI平台上使用,支持无服务器推理API和控制台代理,简化AI应用开发。
GPT-5已在DigitalOcean Gradient™ AI平台上线,开发者可通过无服务器推理API或SDK使用。该模型在推理、专业化和性能上有显著提升,适合复杂任务,如财务规划和代码生成。用户可使用OpenAI API密钥集成GPT-5,便于开发高质量应用。
DigitalOcean的GradientAI平台推出了无服务器推理、代理版本控制和知识库引用等新功能,支持OpenAI模型,提升了AI代理的开发体验。用户可通过模板快速创建代理,并利用增强的知识库功能保持信息实时更新。
DigitalOcean GenAI平台推出无服务器推理,简化AI应用开发,消除基础设施管理和多模型提供商的复杂性。开发者可通过单一API快速集成OpenAI等模型,支持动态工作负载,提供统一计费和监控,适用于多种应用场景。
Hugging Face推出了与Fal、Replicate、SambaNova和Together AI的四个无服务器推理提供商的集成,用户可以通过API密钥或Hugging Face路由请求进行推理。这一更新支持多种模型,简化了推理管理,并允许用户快速切换提供商,旨在提升推理速度和准确性,以满足日益增长的AI需求。
本研究提出FusedInf模型交换方法,解决边缘计算中无服务器推理服务的资源限制问题。通过将多个模型组合为有向无环图,执行速度提升14%,内存需求降低至17%。
一项新服务将AI模型的令牌效率提高了5倍,使开发人员能够立即访问在NVIDIA DGX Cloud上运行的NIM微服务。该服务帮助开发人员快速部署大型语言模型,并通过NVIDIA NIM微服务进行优化。推理服务帮助开发人员在Hugging Face Hub上快速原型设计和部署到生产环境中。企业Hub用户可以利用无服务器推理提高灵活性、减少基础设施开销,并通过NVIDIA NIM实现优化性能。这些工具为Hugging Face开发人员提供了在NVIDIA加速基础设施上实验、测试和部署尖端模型的新方法。
完成下面两步后,将自动完成登录并继续当前操作。