在线教程|不用百亿参数也能跑Agent!Boss直聘南北阁实验室开源Nanbeige4.2-3B,让小模型拥有「大脑」

在线教程|不用百亿参数也能跑Agent!Boss直聘南北阁实验室开源Nanbeige4.2-3B,让小模型拥有「大脑」

💡 原文中文,约1200字,阅读约需3分钟。
📝

内容提要

南北阁实验室发布Nanbeige4.2-3B模型,采用Looped Transformer架构,仅30亿参数,在Agent基准测试中表现优异,如SWE-Bench得分63.6,GPQA-Diamond得分87.4。支持Thinking Mode和262K上下文,已在HyperAI平台上线,便于开发者低成本探索本地智能体应用。

🔎

延伸解读

架构创新:Looped Transformer 如何以小博大

Nanbeige4.2-3B 采用 Looped Transformer 架构,通过复用 Transformer 层来提升模型容量,在不增加参数量的前提下增强表现。这种设计使得仅 30 亿非嵌入参数的模型能在多个 Agent 基准测试中超越更大规模的对手,如 Qwen3.5-9B 和 Gemma4-12B。对于开发者而言,这意味着可以在更低的显存和部署成本下获得接近大模型的智能体能力,降低了本地运行高性能智能体的门槛。

Agent 能力实测:代码与科学推理表现亮眼

在 Agent 基准测试中,Nanbeige4.2-3B 在 SWE-Bench Verified 上取得 63.6 分,在 GPQA-Diamond 上达到 87.4 分,显示出其在代码智能体和科学推理任务上的竞争力。此外,模型支持 Thinking Mode,针对数学、代码及科学推理场景进行了优化。这些数据表明,小参数模型在特定任务上可以具备与更大模型相当的能力,为资源受限的场景提供了新的选择。

部署与使用:HyperAI 平台降低探索门槛

Nanbeige4.2-3B 已在 HyperAI 平台上线,提供在线教程和 Notebook 环境,支持一键克隆和运行。用户可以选择 NVIDIA RTX 5090 和 PyTorch 镜像,快速启动 Jupyter Workspace,并通过 Open WebUI 进行交互。这一流程简化了模型部署的复杂度,使开发者能够以较低成本探索本地智能体应用,尤其适合希望快速验证模型效果的个人或小团队。

Q&A

Nanbeige4.2-3B模型的主要特点是什么?

Nanbeige4.2-3B是Boss直聘南北阁实验室推出的紧凑型智能体模型,采用Looped Transformer架构,仅30亿非嵌入参数,支持Thinking Mode和262K上下文窗口,在多个Agent基准测试中表现优异。

Nanbeige4.2-3B在SWE-Bench Verified和GPQA-Diamond上的得分是多少?

Nanbeige4.2-3B在SWE-Bench Verified上得分为63.6,在GPQA-Diamond上得分为87.4。

Nanbeige4.2-3B如何在不增加参数量的情况下提升模型容量?

Nanbeige4.2-3B采用Looped Transformer架构,通过复用Transformer层来提升模型容量,从而在不增加参数量的前提下增强表现。

Nanbeige4.2-3B支持的最大上下文长度是多少?

Nanbeige4.2-3B支持最长262K tokens的上下文窗口,适用于长文档、多轮对话和复杂工作流。

Nanbeige4.2-3B在HyperAI平台上如何运行?

在HyperAI平台,进入教程页面选择Nanbeige4.2-3B教程,点击运行,克隆至容器,选择NVIDIA RTX 5090和PyTorch镜像,继续执行,等待资源分配后打开Jupyter Workspace,运行README并启动Open WebUI即可。

Nanbeige4.2-3B与Qwen3.5-9B和Gemma4-12B相比表现如何?

Nanbeige4.2-3B在多个Agent基准测试中超越了更大规模的对手,包括Qwen3.5-9B和Gemma4-12B。

🏷️

标签

➡️

继续阅读