英特尔发布 OpenVINO 2026,改进了 NPU 处理能力,并扩展了对 LLM 的支持

英特尔发布 OpenVINO 2026,改进了 NPU 处理能力,并扩展了对 LLM 的支持

💡 原文中文,约1000字,阅读约需3分钟。
📝

内容提要

英特尔发布了 OpenVINO 2026.0,增强了对大型语言模型的支持,改进了酷睿 Ultra NPU 的兼容性,新增多种模型执行支持,并提升转录和字幕功能的准确性。同时,该版本优化了内存需求和性能,支持提前编译,以加速集成和价值实现。

🎯

关键要点

  • 英特尔发布了 OpenVINO 2026.0,增强了对大型语言模型的支持。

  • 改进了对英特尔酷睿 Ultra NPU 的兼容性。

  • 新增对 GPT-OSS-20B、MiniCPM-V-4_5-8B 和 MiniCPM-o-2.6 模型的 CPU 和 GPU 执行支持。

  • OpenVINO 现在支持词级时间戳,提升转录和字幕功能的准确性。

  • 支持针对 3D MatMuls 的 int4 数据感知权重压缩,降低内存/带宽需求并提高精度。

  • 增强了 Agentic AI 框架与 OpenVINO GenAI 的集成,支持 NPU 上的推测性解码。

  • 提供与 NPU 插件的编译器集成,支持提前编译和设备端编译。

  • 目标是提供一个单一的、可立即交付的软件包,以减少集成摩擦并加快价值实现速度。

🔎

延伸解读

大型语言模型的支持扩展

OpenVINO 2026.0 增强了对大型语言模型的支持,尤其是对 GPT-OSS-20B 的正式支持。这一变化意味着开发者可以更方便地在英特尔平台上实现更复杂的自然语言处理任务,提升应用的智能化水平。

内存和性能优化

新版本通过支持 int4 数据感知权重压缩,显著降低了内存和带宽需求。这对于资源受限的设备尤为重要,能够在不牺牲性能的情况下,提升模型的运行效率,适合在边缘计算场景中应用。

集成与编译的便利性

OpenVINO 2026.0 提供了与 NPU 插件的编译器集成,支持提前编译和设备端编译。这一功能的引入将减少开发者在集成过程中的摩擦,帮助他们更快地实现产品价值,适应快速变化的市场需求。

延伸问答

OpenVINO 2026.0 有哪些主要改进?

OpenVINO 2026.0 增强了对大型语言模型的支持,改进了酷睿 Ultra NPU 的兼容性,新增多种模型执行支持,并提升了转录和字幕功能的准确性。

OpenVINO 2026.0 支持哪些新模型?

新增对 GPT-OSS-20B、MiniCPM-V-4_5-8B 和 MiniCPM-o-2.6 模型的 CPU 和 GPU 执行支持。

OpenVINO 2026.0 如何提升转录和字幕功能的准确性?

OpenVINO 2026.0 支持词级时间戳,从而增强转录和字幕功能的准确性。

OpenVINO 2026.0 对内存需求有什么优化?

该版本支持针对 3D MatMuls 的 int4 数据感知权重压缩,降低内存和带宽需求并提高精度。

如何获取 OpenVINO 2026.0?

您可以通过 GitHub 下载 OpenVINO 2026.0 版本并了解更多详细信息。

OpenVINO 2026.0 的目标是什么?

Intel 的目标是提供一个单一的、可立即交付的软件包,以减少集成摩擦并加快价值实现速度。

🏷️

标签

➡️

继续阅读