随着大语言模型向智能体方向演进工具调用、任务规划、多步骤执行等能力成为刚需。但这类能力通常依赖更大参数规模随之而来的是显存占用和部署成本的上升本地运行高性能智能体面临门槛。Boss直聘南北阁实验室推出的 Nanbeige4.2-3B 试图打破这一桎梏。该模型基于 Nanbeige4.2-3B-Base 构建采用 Looped Transformer 架构通过复用 Transformer 层提升模型容量——在不增加参数量的前提下增强表现。模型仅含 30 亿非嵌入参数总参数量约 40 亿却在多个 Agent 基准测试中超越更大规模对手包括 Qwen3.5-9B 和 Gemma4-12B。具体来看Nanbeige4.2-3B 在代码智能体任务 SWE-Bench Verified 中取得 63.6 分在科学推理基准 GPQA-Diamond 中达到 87.4 分。除 Agent 能力外模型还针对推理场景做了专门优化支持 Thinking Mode在数学、代码及科学推理任务中保持竞争力。上下文窗口最长支持 262K tokens覆盖长文档、多轮对话与复杂工作流。「Nanbeige4.2-3B紧凑型智能体模型」已在 HyperAIhyper.ai上线帮助开发者以更低成本探索本地智能体应用感兴趣的小伙伴快来一键探索吧⬇️在线运行Nanbeige4.2-3B: A Compact Agent Model | Notebooks | HyperAIdemo 示例更多在线教程Notebooks | HyperAIDemo 运行1、进入 hyper.ai 首页后选择「教程」页面或点击「查看更多教程」选择「Nanbeige4.2-3B紧凑型智能体模型」点击「运行此教程」。2.页面跳转后点击右上角「Clone」将该教程克隆至自己的容器中。注页面右上角支持切换语言目前提供中文及英文两种语言本教程文章以英文为例进行步骤展示。3.选择「NVIDIA RTX 5090」以及「PyTorch」镜像点击「Continue job execution继续执行」。4.等待分配资源当状态变为「Running运行中」后点击「Open Workspace」进入 Jupyter Workspace。效果展示1.页面跳转后点击左侧 README 文件进入后点击上方 Run运行。2.待运行完成根据 README 提示在终端输入代码启动 Open WebUI 后即可点击右侧 API 地址跳转至 demo 页面。