vLLM与NVIDIA合作,在Blackwell GPU上优化gpt-oss-120b模型,提升性能。通过FlashInfer集成、内核融合和运行时改进,实现最大吞吐量提高38%和最佳交互性提升13%。这些优化增强了模型在高并发场景下的表现。
Databricks Agent Bricks是一个企业AI代理构建与优化的平台。通过自动化提示优化技术,gpt-oss-120b模型在信息提取任务中超越了Claude Opus 4.1,且服务成本低90倍。此外,该技术还提升了其他专有模型的性能,提供了优于监督微调的质量-成本平衡,适合企业应用。
OpenAI推出了gpt-oss-120b开源模型,拥有1200亿参数和混合专家架构,适用于文本生成和理解。开发者可根据Apache 2.0许可证进行调整,支持实时任务执行。该模型性能与OpenAI的o4-mini相当,并可在Heroku平台上简化AI基础设施,提供透明定价。
OpenAI发布了gpt-oss-120b和gpt-oss-20b两款开源大模型,前者适合复杂推理,后者适合低延迟应用。gpt-oss采用MoE架构,性能强大且计算需求低,支持在消费级硬件上运行。评测显示,gpt-oss-120b在多个任务中优于o3-mini,gpt-oss-20b表现也很出色。用户可通过HyperAI官网体验和部署这些模型。
OpenAI发布了gpt-oss-120b和gpt-oss-20b两个开放权重语言模型,支持高效推理和工具使用。120b模型可在单个80GB GPU上运行,超越o4-mini;20b模型适合16GB内存的消费级硬件,支持本地推理。两者可配置推理力度,适用于多种应用场景。模型经过风险评估,并接受外部专家审查,推出红队挑战以进一步评估。
OpenAI发布了gpt-oss-120b和gpt-oss-20b两个开源大模型,前者适合复杂推理,后者适合低延迟应用。两者在多项测试中表现优异,能够在消费级硬件上运行,满足多场景需求。
OpenAI发布了两个开放权重的AI推理模型gpt-oss-120b和gpt-oss-20b,供免费下载。gpt-oss-120b可在单个Nvidia GPU上运行,而gpt-oss-20b适用于16GB内存的笔记本电脑。这是自GPT-2以来首次发布的开放语言模型。
OpenAI 开源了两款轻量级语言模型 gpt-oss-120b 和 gpt-oss-20b,均基于 Transformer 架构,支持商用。gpt-oss-120b 拥有 1170 亿参数,适合高性能需求;gpt-oss-20b 拥有 210 亿参数,适合边缘设备。两者可在 Hugging Face 下载和在线试用。
亚马逊云科技宣布,OpenAI的开放权重模型首次通过Amazon Bedrock和SageMaker AI可用,助力客户构建生成式AI应用。新模型gpt-oss-120b和gpt-oss-20b提供强大技术,支持高效Agent部署,具备生产级扩展性与安全性。
OpenAI推出了gpt-oss-120b和gpt-oss-20b两个开放权重推理模型,旨在支持指令执行和工具使用。尽管模型遵循安全政策,但仍需额外保护以防滥用。评估结果显示,gpt-oss-120b在生物、化学和网络能力方面未达到高标准,且未能显著提升开放基础模型的生物能力。
完成下面两步后,将自动完成登录并继续当前操作。