NemoClaw DGX Spark Express 安装指南:托管 vLLM 自动选型与固定 Qwen3.6 35B 推理方案解析
NemoClaw DGX Spark Express 安装指南托管 vLLM 自动选型与固定 Qwen3.6 35B 推理方案解析【免费下载链接】NemoClawRun agents like Hermes, LangChain Deep Agents, and OpenClaw more securely inside NVIDIA OpenShell with managed inference项目地址: https://gitcode.com/gh_mirrors/ne/NemoClaw本篇技术指南聚焦 NVIDIA NemoClaw 在DGX Spark硬件上的 Express 一键安装流程讲解安装器如何在硬件检测确认后提供两套 DGX Spark 推理配置托管 vLLM 自动 serving-profile 选型与固定 catalog-backed vLLM profile以及对应的全部环境变量语义与交互确认步骤。读完本文你将掌握 DGX Spark Express 安装的完整决策路径、可复现的非交互环境变量组合、两套推理方案各自的约束边界以及安装完成后如何验证实际生效的模型。适用前提仅在硬件检测确认 DGX Spark 后启用DGX Spark Express 指令有一个硬性前提只有在安装器硬件检测确认主机为 DGX Spark 之后才可使用。安装器不会仅凭 GPU 名称就判定机型而是综合产品、固件、架构与 GPU 证据做判定。在安装脚本 scripts/install.sh 中detect_express_platform()依次执行如下判定逻辑先判断是否为 Windows WSL 主机is_wsl_host再通过classify_dgx_station_hardware()读取固件身份DMI 优先、devicetree 兜底固件状态为spark时输出DGX Spark固件状态不明确时回退检查受信任的/etc/fastos-release标记spark_fastos_release_is_trusted其中对NAMEDGX SPARK FASTOS的读取过程做了严格的元数据完整性校验文件类型、属主、权限位、大小上界、内容校验防止路径替换或内容篡改。只有检测结果为DGX Spark时安装器才会进入 Express 提示流程其他平台DGX Station、N1x、Windows WSL、普通主机分别加载各自的平台指令资产。平台资产的加载入口定义在 docs/resources/starter-prompt.md其中明确读取匹配的原始 Markdown 文件全文并遵循它不得为其他电脑加载平台资产。Express 流程概览保持 Agent、默认选项、两种推理选择Express 安装的核心设计意图是保留用户已在起始提示starter prompt中选择的 Agent将可选配置全部留在默认值并针对 DGX Spark 提供两套推理设置。安装器只问最少的问题把其余决策全部交给预先定义好的非交互环境变量。在 scripts/install.sh 中select_spark_express_inference()向用户展示二选一菜单Choose the DGX Spark inference setup: 1) Managed vLLM with automatic serving-profile selection (default) 2) Qwen3.6 35B-A3B NVFP4 with the fixed catalog-backed vLLM profile Choose 1 or 2 [1]:两个选项分别是选项推理方案默认1Managed vLLM带自动 serving-profile 选择是直接回车或输入 12nvidia/Qwen3.6-35B-A3B-NVFP4使用固定的 catalog-backed vLLM profile否值得注意的是如果用户已经在环境中显式设置了NEMOCLAW_MODEL或NEMOCLAW_VLLM_MODELselect_spark_express_inference会直接返回、跳过这个菜单见 scripts/install.sh因为显式模型意图本身已经决定走哪条路径。用户做出选择后安装器通过describe_express_install完整披露本次安装将配置的推理摘要、边界说明、沙箱名与策略模式scripts/install.sh随后展示第三方软件通知再询问Run express install with these settings? [Y/n]:用户输入回车、y或yes视为接受其余输入视为拒绝并回退到常规交互式 provider 选择流程scripts/install.sh。方案一Managed vLLM 自动 serving-profile 选择默认当用户选择选项 1 时activate_express_install对 DGX Spark 分支执行如下环境变量配置scripts/install.sh设置NEMOCLAW_PROVIDERinstall-vllm保持NEMOCLAW_ENABLE_LOCAL_MODEL_PROFILE、NEMOCLAW_LOCAL_MODEL_RUNTIME、NEMOCLAW_MODEL、NEMOCLAW_VLLM_MODEL全部未设置其中前两个被显式unset若用户在环境中显式提供了NEMOCLAW_VLLM_MODEL则保留并透传该值显式模型保持权威性。自动选型原理install-vllm这一 provider 值对应安装并托管 vLLM 服务后端的 onboarding 分支。在 src/lib/inference/serving/profile-list.ts 中servingBackendProviderKey()将vllm后端映射为install-vllmprovider保证列表里展示的每个兼容 profile 都有可执行的 provider 来运行它。在没有任何显式推理意图或相关运行时的情况下安装器会从 serving catalog 中选取恰好一个经过资质认证的预信任托管集群拓扑匹配对应的钉死pinned分布式 profile若普通无匹配情况则沿用既有的单主机 DGX Spark profile。任何相关或模糊的已有设置都会让安装停止而不是被覆盖。describe_express_install中的披露原文明确指出scripts/install.shWith no explicit inference intent or related runtime, one exactly qualified pretrusted managed cluster topology selects a matching pinned distributed profile. An ordinary no-match keeps the existing single-host DGX Spark profile; any related or ambiguous setup remains untouched and stops installation.profile 的自动选择基于 preset 的selection: automatic与priority排序结合每节点 readiness 检查平台资质、Docker 可用性、GPU 可用性等过滤出兼容项兼容性评估逻辑见 src/lib/inference/serving/profile-list.ts。显式模型时的行为差异若设置了NEMOCLAW_VLLM_MODEL披露为 managed local vLLM with model …保留既有单主机 DGX Spark profile管理式 vLLM 仅拉取配置的镜像/模型并运行专用容器若只设置了NEMOCLAW_MODEL披露为 managed local vLLM with explicit model intent …走可定制的 managed-vLLM 路径且不再提供固定 profile 选项。安装器集成测试 test/installer-integration/install-express-prompt.test.ts 验证了显式NEMOCLAW_VLLM_MODELcustom-qwen3.6时导出结果为PROVIDERinstall-vllm MODEL VLLM_MODELcustom-qwen3.6而显式NEMOCLAW_MODELcatalog/model时导出MODELcatalog/model VLLM_MODEL且不出现固定 profile 菜单。方案二固定 catalog-backed vLLM profileQwen3.6 35B-A3B NVFP4当用户选择选项 2 时activate_express_install对 DGX Spark 分支执行如下环境变量配置scripts/install.sh设置NEMOCLAW_ENABLE_LOCAL_MODEL_PROFILE1与NEMOCLAW_LOCAL_MODEL_RUNTIMEvllm保持NEMOCLAW_PROVIDER、NEMOCLAW_MODEL、NEMOCLAW_VLLM_MODEL、NEMOCLAW_VLLM_EXTRA_ARGS_JSON全部未设置保留用户已有的NEMOCLAW_VLLM_PORT主机端口覆盖。该方案由 serving catalog 全权决定固定模型、运行时镜像、容器端口与 vLLM 参数。固定的模型为nvidia/Qwen3.6-35B-A3B-NVFP4对应的 preset 定义在 managed-inference/presets/vllm.dgx-spark-gb10.single.qwen3-6-35b-a3b-nvfp4.yaml其supportState: supported、验证级别为hardware证据preexisting-supported-profile-v0.0.109通过host.platform.dgx_spark资质与 Docker 就绪等条件参与自动选择。覆盖保护的强制约束固定 profile 路径对用户覆盖实施严格拒绝策略。activate_express_install中若检测到NEMOCLAW_PROVIDER、NEMOCLAW_MODEL、NEMOCLAW_VLLM_MODEL或NEMOCLAW_VLLM_EXTRA_ARGS_JSON任一被设置会直接报错并中止The fixed DGX Spark vLLM profile does not accept provider, model, or serve-argument overrides.这一约束有两层防线见 scripts/install.sh 与披露文本 scripts/install.sh安装器层面拒绝 provider / model / serve-argument 覆盖专用 local-model onboarder 层面在启动托管容器前拒绝 vLLM model 与 serve-argument 覆盖。而NEMOCLAW_VLLM_PORT是唯一被允许的例外——它只用于覆盖主机侧监听端口。测试 test/installer-integration/install-express-prompt.test.ts 同时验证了两点设置NEMOCLAW_VLLM_EXTRA_ARGS_JSON[--max-model-len,4096]时安装被拒绝且不导出任何结果环境变量而设置NEMOCLAW_VLLM_PORT18000时安装正常继续PROFILE_GATE1 PROFILE_RUNTIMEvllm SPARK_SELECTIONfixed-vllm。local-model profile 的运行时约束NEMOCLAW_ENABLE_LOCAL_MODEL_PROFILE1与NEMOCLAW_LOCAL_MODEL_RUNTIMEvllm激活的是本地模型 profile 路径。在 src/lib/onboard/local-model-profile/plan.ts 中LOCAL_MODEL_PROFILE_RUNTIME_ENV的合法取值目前只有vllm并且 profile 计划还要求 recipe 满足backend 为vllm、materializer 为vllm.host-local/v1、lifecycle 为vllm.host-local.lifecycle/v1——这保证了固定 profile路径只通过本机托管 vLLM 执行不引入其他运行时。两种方案共用的 Express 环境变量无论用户选择方案一还是方案二只要接受 Expressactivate_express_installscripts/install.sh都会统一设置以下环境变量环境变量取值作用NEMOCLAW_AGENT起始提示中已选的 Agentopenclaw / hermes / langchain-deepagents-code锁定目标 Agent不再重复询问NEMOCLAW_NON_INTERACTIVE11关闭安装器交互提示NEMOCLAW_NON_INTERACTIVE_SUDO_MODEpromptprompt非交互模式下仍通过系统sudo安全收集管理员密码NEMOCLAW_YES11接受默认确认项NEMOCLAW_POLICY_MODEsuggestedsuggested使用建议策略模式默认 tier 为 balancedNEMOCLAW_ACCEPT_THIRD_PARTY_SOFTWARE11接受已披露的第三方软件声明同时以下变量被显式保持未设置让安装器应用剩余的 Express 默认值NEMOCLAW_SANDBOX_NAME默认回退为my-assistant见 scripts/install.shNEMOCLAW_POLICY_TIER默认balanced披露为suggested mode, tier balanced见 scripts/install.sh 与 test/installer-integration/install-express-prompt.test.tsweb-search 设置与 messaging 设置。一个重要的权限语义是Express 确认本身即视为对已披露通知、下载与安装的批准因此后续不再弹出最终许可提示同时安装器也不会再次询问 Agent也不会分别询问模型、沙箱名、web search、messaging、策略、下载批准或最终安装批准等问题。这也意味着整个安装以完全非交互方式推进仅 sudo 按需提示与 docs/resources/starter-prompt.md 中收集完所有选择后再运行安装器、绝不让命令停在Choose [1]:的约束一致。安装完成后需要向用户报告安装版本实际选中的模型。测试对完整导出结果的验证安装器集成测试对两种方案的最终导出环境做了精确断言test/installer-integration/install-express-prompt.test.ts 与 第232-233行方案一RESULT NON_INTERACTIVE1 SUDO_MODEprompt PROVIDERinstall-vllm MODEL VLLM_MODEL POLICYsuggested YES1 SANDBOXmy-assistant STATION_EXPRESS PROFILE_GATE PROFILE_RUNTIME SPARK_SELECTIONmanaged-vllm 方案二RESULT NON_INTERACTIVE1 SUDO_MODEprompt PROVIDER MODEL VLLM_MODEL POLICYsuggested YES1 SANDBOXmy-assistant STATION_EXPRESS PROFILE_GATE1 PROFILE_RUNTIMEvllm SPARK_SELECTIONfixed-vllm可以看到方案二通过PROFILE_GATE1 PROFILE_RUNTIMEvllm激活 local-model profile而方案一则走PROVIDERinstall-vllm的托管 vLLM provider 路径两者在环境导出上互斥且可区分。Express 被拒绝后的常规 provider 选择如果用户拒绝 Express输入n或其他非确认值安装器将回退到常规交互式 provider 选择流程scripts/install.sh并遵循 docs/resources/starter-prompt.md 中的 provider 菜单。对 DGX Spark 场景常规流程会提供已有 vLLM当检测到localhost:${NEMOCLAW_VLLM_PORT:-8000}上有就绪服务时提供Managed vLLM优化的本地推理附带大体积下载本地 Ollama仅当所选 Agent 与平台支持时提供所选 Agent 支持的全部托管或兼容 providerNVIDIA Endpoints、OpenRouter、OpenAI、Anthropic、Gemini、Model Router、其他 OpenAI/Anthropic 兼容端点、Hermes Provider 等。常规流程下非交互映射参考 starter prompt 的 provider 对照表docs/resources/starter-prompt.md例如 Managed vLLM 对应NEMOCLAW_PROVIDERinstall-vllm、已有 vLLM 对应NEMOCLAW_PROVIDERvllm。总结DGX Spark Express 的关键决策路径安装器通过固件 FastOS 标记双重证据确认 DGX Spark询问两套推理方案Managed vLLM 自动选型默认或固定 Qwen3.6 35B-A3B NVFP4 catalog profile披露推理摘要、边界、沙箱名与策略展示第三方软件通知再请求最终确认接受后统一导出NEMOCLAW_NON_INTERACTIVE1、NEMOCLAW_NON_INTERACTIVE_SUDO_MODEprompt、NEMOCLAW_YES1、NEMOCLAW_POLICY_MODEsuggested、NEMOCLAW_ACCEPT_THIRD_PARTY_SOFTWARE1并按方案差异导出 provider 或 local-model profile 变量全程不再重复询问 Agent 与各类可选设置安装完成后报告实际选中的模型拒绝 Express 则进入常规 provider 菜单按需提供已有 vLLM、托管 vLLM、本地 Ollama 与托管/兼容 provider。【免费下载链接】NemoClawRun agents like Hermes, LangChain Deep Agents, and OpenClaw more securely inside NVIDIA OpenShell with managed inference项目地址: https://gitcode.com/gh_mirrors/ne/NemoClaw创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

TiXL 节点详解:Combine3Images —— 用三张输入图像重组 RGBA 通道

TiXL 节点详解:Combine3Images —— 用三张输入图像重组 RGBA 通道

音视频图形学桌面应用 【免费下载链接】t3 TiXL is an open source software to create realtime motion graphics. 项目地址: https://gitcode.com/GitHub_Trending/t3/t3 点击查看 免费下载 本篇技术指南围绕 TiXL(tooll3/t3 实时动态图形创作工具&am…

2026/9/20 23:34:49 阅读更多 →
Octop COS/S3 远程存储后端完整指南:3 步把 Agent 工作区送上云

Octop COS/S3 远程存储后端完整指南:3 步把 Agent 工作区送上云

Octop COS/S3 远程存储后端完整指南:3 步把 Agent 工作区送上云 【免费下载链接】Octop A smarter, self-hosted AI assistant — multi-user, multi-agent. 项目地址: https://gitcode.com/GitHub_Trending/oct/Octop Octop 是一个更聪明、可自托管&#xf…

2026/9/20 23:34:49 阅读更多 →
使用 chezmoi data 命令输出与调试模板数据

使用 chezmoi data 命令输出与调试模板数据

开发工具CLI配置管理 【免费下载链接】chezmoi Manage your dotfiles across multiple diverse machines, securely. 项目地址: https://gitcode.com/gh_mirrors/ch/chezmoi 点击查看 免费下载 导读 chezmoi 的 data 子命令用于把**计算完成后的模板数据&#xff…

2026/9/20 23:34:49 阅读更多 →

最新新闻

Atlas 300V实战:从环境搭建到YOLO推理部署全攻略

Atlas 300V实战:从环境搭建到YOLO推理部署全攻略

最近一直在折腾 Atlas 300V 24G 这张卡,起因是手头有个项目需要在边缘侧跑 YOLO 目标检测,客户点名要华为昇腾的方案。说实话,刚开始我对这类 NPU 推理加速卡也有点拿不准——它到底算不算“运算加速卡”?和 GPU 的工作方式差异大…

2026/9/21 0:10:07 阅读更多 →
OpenClaw Installer 装完,Agent 跑模型任务:Key 从 TaoToken 拿

OpenClaw Installer 装完,Agent 跑模型任务:Key 从 TaoToken 拿

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/21 0:10:06 阅读更多 →
TaoToken + Cline:401 invalid_api_key 报错?这样核对模型 ID

TaoToken + Cline:401 invalid_api_key 报错?这样核对模型 ID

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/21 0:10:06 阅读更多 →
Relay 编译器中 docblock-shared:Relay Resolvers 的 SDL 指令与 Docblock 标签共享契约解析

Relay 编译器中 docblock-shared:Relay Resolvers 的 SDL 指令与 Docblock 标签共享契约解析

前端开发工具 【免费下载链接】relay Relay is a JavaScript framework for building data-driven React applications. 项目地址: https://gitcode.com/gh_mirrors/relay29/relay 点击查看 免费下载 导读 在 Relay 的 Rust 编译器中,docblock-shared …

2026/9/21 0:10:06 阅读更多 →
python-sdk 部署与水平扩展实战:Host 白名单、Worker 粘性与跨副本一致性

python-sdk 部署与水平扩展实战:Host 白名单、Worker 粘性与跨副本一致性

人工智能MCP 服务MCP Clients 【免费下载链接】python-sdk The official Python SDK for Model Context Protocol servers and clients 项目地址: https://gitcode.com/gh_mirrors/pythonsd/python-sdk 点击查看 免费下载 导读 本文基于 Model Context Protocol 官…

2026/9/21 0:10:06 阅读更多 →
B站视频批量下载工具DownKyi使用指南

B站视频批量下载工具DownKyi使用指南

1. 工具概述与使用场景DownKyi是一款免安装的B站视频批量下载工具,最新版本解决了旧版失效问题。作为经常需要批量下载B站视频的创作者,我发现这个工具特别适合以下场景:需要离线观看的教程类视频收藏素材收集(如影视剪辑、鬼畜素…

2026/9/21 0:09:06 阅读更多 →

日新闻

agents-generator 决策矩阵全解析:从项目检测到 AGENTS.md 规则生成的 16 步判定流程

agents-generator 决策矩阵全解析:从项目检测到 AGENTS.md 规则生成的 16 步判定流程

agents-generator 决策矩阵全解析:从项目检测到 AGENTS.md 规则生成的 16 步判定流程 【免费下载链接】agentic-awesome-skills AAS Core is the local, agent-first control plane for complete catalog discovery, agent-owned selection, stack validation, and …

2026/9/21 0:00:01 阅读更多 →
gin-vue-admin 前端工具函数全景指南:src/utils 复用规范与源码级解析

gin-vue-admin 前端工具函数全景指南:src/utils 复用规范与源码级解析

gin-vue-admin 前端工具函数全景指南:src/utils 复用规范与源码级解析 【免费下载链接】gin-vue-admin 🚀ViteVue3Gin拥有AI辅助的基础开发平台,企业级业务AI开发解决方案,内置mcp辅助服务,内置skills管理,…

2026/9/21 0:00:01 阅读更多 →
Wox 全功能插件开发实战指南:基于 Python / Node.js 宿主与 WebSocket 的持久化插件体系

Wox 全功能插件开发实战指南:基于 Python / Node.js 宿主与 WebSocket 的持久化插件体系

桌面应用AI 应用插件系统 【免费下载链接】Wox A cross-platform launcher that simply works 项目地址: https://gitcode.com/gh_mirrors/wo/Wox 点击查看 免费下载 全功能插件(Full-featured Plugin)是 Wox 三类插件实现方式中能力最完整的…

2026/9/21 0:00:01 阅读更多 →

周新闻

Flutter for OpenHarmony游戏卡片渐变背景实战:从原理到性能优化

Flutter for OpenHarmony游戏卡片渐变背景实战:从原理到性能优化

直接铺开项目本身吧。这几个月我一直在折腾一件事:用Flutter给OpenHarmony做一款游戏集合类的App,说白了就是把若干小游戏塞进一个壳里,用统一入口分发。这个方向本身不算新鲜,真正让我花了不少心思的,是首页那堆游戏卡…

2026/9/20 0:00:46 阅读更多 →
Word表格编号全攻略:从列表编号到题注交叉引用

Word表格编号全攻略:从列表编号到题注交叉引用

写Word文档,最让人头疼的往往是那些“看起来不起眼”的小问题。比如表格编号这事:今天在表后面多加了两个空白行,明天给客户交稿前发现整个章节的编号全部错位,光是挨个改序号就能耗掉大半个下午。我前阵子帮人整理一份上百页的技…

2026/9/20 0:00:46 阅读更多 →
从第一个站到第二个站:独立开发者的静态网站选型与落地实践

从第一个站到第二个站:独立开发者的静态网站选型与落地实践

1. 项目概述1.1 核心需求解析做独立开发者这几年,说实话,第一个网站上线的那天晚上我兴奋得没睡着。但等它跑了半年,流量惨淡、功能臃肿、代码自己都懒得看第二遍之后,我才慢慢琢磨明白一个道理:第一个网站是练手&…

2026/9/20 0:00:46 阅读更多 →

月新闻

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能分类:[AI/大模型]细分主题:AI 增强型 CI/CD 流水线自动化与 GitOps 实践:Agent 工作流、工具调用与任务拆解:从原型到生产的验收清单很多团队在尝试用大…

2026/9/19 23:01:36 阅读更多 →
容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场分类:[工程技术]细分主题:Kubernetes 生产环境运维与排障实战:可复制的项目复盘模板与决策记录大部分团队的事故复盘报告,最后都变成了躺在 Confluence 或钉…

2026/9/19 17:50:38 阅读更多 →
容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步

容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步

容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步分类:[工程技术]细分主题:Docker 容器化技术与镜像安全管理:核心链路的逐步实现与关键代码取舍面对一个积累了五六年历史包袱的单体架构应用(包含 Web 接口、后台…

2026/9/19 23:35:34 阅读更多 →