内容提要
Qwen3.8-27B开源模型发布,拥有270亿参数,强化推理、编程与Agent能力,在代码、多模态和智能体评测中表现优异,接近顶级闭源模型。支持图像视频理解及灵活思考控制,HyperAI已上线教程供开发者快速调用。
延伸解读
评测分数背后的意义
文章给出的SWE-bench Verified 72.4分、LiveCodeBench v6 80.7分等数据,表明Qwen3.8-27B在代码生成和修复任务上接近更大规模模型。但评测集不能完全代表真实开发场景,实际效果还需结合具体任务验证。
多模态与Agent能力的实际应用
模型支持图像、视频理解,可处理科学图表和长视频,同时强化了自主规划与工具调用。这意味着它不仅能做代码助手,还能在文档分析、自动化操作等场景中发挥作用。但Agent能力在复杂真实环境中的稳定性仍需观察。
思考控制机制的价值
灵活的思考控制允许用户调整推理深度,在效果与效率间取得平衡。对于成本敏感或延迟敏感的应用,这一特性可能比单纯追求性能更有实用价值。不过,如何权衡深度与输出质量,需要开发者根据实际需求测试。
Q&A
Qwen3.8-27B是什么?它有哪些主要特点?
Qwen3.8-27B是Qwen系列最新开源的模型,拥有270亿参数,基于Qwen3.5架构优化升级,全面强化了推理、编程与Agent能力。它支持图像和视频理解,并具备灵活的思考控制机制,用户可根据需求调整推理深度。
Qwen3.8-27B在代码能力上的表现如何?
在代码能力方面,Qwen3.8-27B在SWE-bench Verified上达到72.4分,在LiveCodeBench v6上达到80.7分,展现出接近更大规模模型的复杂编程能力。
Qwen3.8-27B支持哪些多模态任务?
作为原生视觉语言模型,Qwen3.8-27B支持图像与视频理解,可处理科学图表、文档解析、长视频分析等多模态任务。在OmniDocBench1.5上达到88.9分,在VideoMME上达到87.0分。
Qwen3.8-27B在智能体(Agent)能力上有哪些提升?
Qwen3.8-27B强化了自主规划、工具调用与环境反馈能力,能够围绕复杂目标拆解任务并持续执行。在Agent评测中,ScreenSpot Pro达到70.3分,OSWorld-Verified达到56.2分,提升了真实环境下的任务完成能力。
Qwen3.8-27B的思考控制机制是什么?有什么作用?
Qwen3.8-27B支持灵活的思考控制机制,用户可以根据需求调整推理深度,从而在效果与效率之间实现平衡。
如何在HyperAI上运行Qwen3.8-27B-FP8教程?
在HyperAI官网(hyper.ai)的教程板块选择「Qwen3.8-27B-FP8:原生视觉语言模型」,点击「运行此教程」。然后点击右上角「Clone」克隆教程,选择「NVIDIA RTX 5090-2」和「vllm」镜像,点击「Continue job execution」。等待资源分配,状态变为「Running」后点击「Open Workspace」进入Jupyter Workspace。之后运行README文件,打开新终端启动Open WebUI,点击API地址即可访问界面。
Qwen3.8-27B与顶级闭源模型相比表现如何?
在官方多项评测中,Qwen3.8-27B已经开始向Claude等顶级闭源模型发起正面挑战,在代码、多模态和智能体评测中表现优异,接近顶级闭源模型。