NemoClaw DGX Spark Express 安装指南:托管 vLLM 自动选型与固定 Qwen3.6 35B 推理方案解析
2026/9/20 23:34:40 网站建设 项目流程

NemoClaw DGX Spark Express 安装指南:托管 vLLM 自动选型与固定 Qwen3.6 35B 推理方案解析

【免费下载链接】NemoClawRun agents like Hermes, LangChain Deep Agents, and OpenClaw more securely inside NVIDIA OpenShell with managed inference项目地址: https://gitcode.com/gh_mirrors/ne/NemoClaw

本篇技术指南聚焦 NVIDIA NemoClaw 在DGX Spark硬件上的 Express 一键安装流程,讲解安装器如何在硬件检测确认后提供两套 DGX Spark 推理配置(托管 vLLM 自动 serving-profile 选型与固定 catalog-backed vLLM profile),以及对应的全部环境变量语义与交互确认步骤。读完本文,你将掌握 DGX Spark Express 安装的完整决策路径、可复现的非交互环境变量组合、两套推理方案各自的约束边界,以及安装完成后如何验证实际生效的模型。

适用前提:仅在硬件检测确认 DGX Spark 后启用

DGX Spark Express 指令有一个硬性前提:只有在安装器硬件检测确认主机为 DGX Spark 之后才可使用。安装器不会仅凭 GPU 名称就判定机型,而是综合产品、固件、架构与 GPU 证据做判定。

在安装脚本 scripts/install.sh 中,detect_express_platform()依次执行如下判定逻辑:

  1. 先判断是否为 Windows WSL 主机(is_wsl_host);
  2. 再通过classify_dgx_station_hardware()读取固件身份(DMI 优先、devicetree 兜底),固件状态为spark时输出DGX Spark
  3. 固件状态不明确时,回退检查受信任的/etc/fastos-release标记(spark_fastos_release_is_trusted),其中对NAME="DGX SPARK FASTOS"的读取过程做了严格的元数据完整性校验(文件类型、属主、权限位、大小上界、内容校验),防止路径替换或内容篡改。

只有检测结果为DGX Spark时,安装器才会进入 Express 提示流程;其他平台(DGX Station、N1x、Windows WSL、普通主机)分别加载各自的平台指令资产。平台资产的加载入口定义在 docs/resources/starter-prompt.md,其中明确"读取匹配的原始 Markdown 文件全文并遵循它,不得为其他电脑加载平台资产"。

Express 流程概览:保持 Agent、默认选项、两种推理选择

Express 安装的核心设计意图是:保留用户已在起始提示(starter prompt)中选择的 Agent,将可选配置全部留在默认值,并针对 DGX Spark 提供两套推理设置。安装器只问最少的问题,把其余决策全部交给预先定义好的非交互环境变量。

在 scripts/install.sh 中,select_spark_express_inference()向用户展示二选一菜单:

Choose the DGX Spark inference setup: 1) Managed vLLM with automatic serving-profile selection (default) 2) Qwen3.6 35B-A3B NVFP4 with the fixed catalog-backed vLLM profile Choose 1 or 2 [1]:

两个选项分别是:

选项推理方案默认
1Managed vLLM,带自动 serving-profile 选择是(直接回车或输入 1)
2nvidia/Qwen3.6-35B-A3B-NVFP4,使用固定的 catalog-backed vLLM profile

值得注意的是:如果用户已经在环境中显式设置了NEMOCLAW_MODELNEMOCLAW_VLLM_MODELselect_spark_express_inference会直接返回、跳过这个菜单(见 scripts/install.sh),因为显式模型意图本身已经决定走哪条路径。

用户做出选择后,安装器通过describe_express_install完整披露本次安装将配置的推理摘要、边界说明、沙箱名与策略模式(scripts/install.sh),随后展示第三方软件通知,再询问:

Run express install with these settings? [Y/n]:

用户输入回车、yyes视为接受;其余输入视为拒绝并回退到常规交互式 provider 选择流程(scripts/install.sh)。

方案一:Managed vLLM 自动 serving-profile 选择(默认)

当用户选择选项 1 时,activate_express_install对 DGX Spark 分支执行如下环境变量配置(scripts/install.sh):

  • 设置NEMOCLAW_PROVIDER=install-vllm
  • 保持NEMOCLAW_ENABLE_LOCAL_MODEL_PROFILENEMOCLAW_LOCAL_MODEL_RUNTIMENEMOCLAW_MODELNEMOCLAW_VLLM_MODEL全部未设置(其中前两个被显式unset);
  • 若用户在环境中显式提供了NEMOCLAW_VLLM_MODEL,则保留并透传该值,显式模型保持权威性。

自动选型原理

install-vllm这一 provider 值对应"安装并托管 vLLM 服务后端"的 onboarding 分支。在 src/lib/inference/serving/profile-list.ts 中,servingBackendProviderKey()vllm后端映射为install-vllmprovider,保证"列表里展示的每个兼容 profile 都有可执行的 provider 来运行它"。

在没有任何显式推理意图或相关运行时的情况下,安装器会从 serving catalog 中选取恰好一个经过资质认证的预信任托管集群拓扑,匹配对应的钉死(pinned)分布式 profile;若普通无匹配情况则沿用既有的单主机 DGX Spark profile。任何相关或模糊的已有设置都会让安装停止而不是被覆盖。describe_express_install中的披露原文明确指出(scripts/install.sh):

With no explicit inference intent or related runtime, one exactly qualified pretrusted managed cluster topology selects a matching pinned distributed profile. An ordinary no-match keeps the existing single-host DGX Spark profile; any related or ambiguous setup remains untouched and stops installation.

profile 的自动选择基于 preset 的selection: automaticpriority排序,结合每节点 readiness 检查(平台资质、Docker 可用性、GPU 可用性等)过滤出兼容项,兼容性评估逻辑见 src/lib/inference/serving/profile-list.ts。

显式模型时的行为差异

  • 若设置了NEMOCLAW_VLLM_MODEL:披露为 "managed local vLLM with model …",保留既有单主机 DGX Spark profile,管理式 vLLM 仅拉取配置的镜像/模型并运行专用容器;
  • 若只设置了NEMOCLAW_MODEL:披露为 "managed local vLLM with explicit model intent …",走可定制的 managed-vLLM 路径,且不再提供固定 profile 选项

安装器集成测试 test/installer-integration/install-express-prompt.test.ts 验证了显式NEMOCLAW_VLLM_MODEL=custom-qwen3.6时导出结果为PROVIDER=install-vllm MODEL= VLLM_MODEL=custom-qwen3.6,而显式NEMOCLAW_MODEL=catalog/model时导出MODEL=catalog/model VLLM_MODEL=且不出现固定 profile 菜单。

方案二:固定 catalog-backed vLLM profile(Qwen3.6 35B-A3B NVFP4)

当用户选择选项 2 时,activate_express_install对 DGX Spark 分支执行如下环境变量配置(scripts/install.sh):

  • 设置NEMOCLAW_ENABLE_LOCAL_MODEL_PROFILE=1NEMOCLAW_LOCAL_MODEL_RUNTIME=vllm
  • 保持NEMOCLAW_PROVIDERNEMOCLAW_MODELNEMOCLAW_VLLM_MODELNEMOCLAW_VLLM_EXTRA_ARGS_JSON全部未设置
  • 保留用户已有的NEMOCLAW_VLLM_PORT主机端口覆盖

该方案由 serving catalog 全权决定固定模型、运行时镜像、容器端口与 vLLM 参数。固定的模型为nvidia/Qwen3.6-35B-A3B-NVFP4,对应的 preset 定义在 managed-inference/presets/vllm.dgx-spark-gb10.single.qwen3-6-35b-a3b-nvfp4.yaml,其supportState: supported、验证级别为hardware(证据preexisting-supported-profile-v0.0.109),通过host.platform.dgx_spark资质与 Docker 就绪等条件参与自动选择。

覆盖保护的强制约束

固定 profile 路径对用户覆盖实施严格拒绝策略。activate_express_install中若检测到NEMOCLAW_PROVIDERNEMOCLAW_MODELNEMOCLAW_VLLM_MODELNEMOCLAW_VLLM_EXTRA_ARGS_JSON任一被设置,会直接报错并中止:

The fixed DGX Spark vLLM profile does not accept provider, model, or serve-argument overrides.

这一约束有两层防线(见 scripts/install.sh 与披露文本 scripts/install.sh):

  1. 安装器层面:拒绝 provider / model / serve-argument 覆盖;
  2. 专用 local-model onboarder 层面:在启动托管容器前,拒绝 vLLM model 与 serve-argument 覆盖。

NEMOCLAW_VLLM_PORT是唯一被允许的例外——它只用于覆盖主机侧监听端口。测试 test/installer-integration/install-express-prompt.test.ts 同时验证了两点:设置NEMOCLAW_VLLM_EXTRA_ARGS_JSON='["--max-model-len","4096"]'时安装被拒绝且不导出任何结果环境变量;而设置NEMOCLAW_VLLM_PORT=18000时安装正常继续(PROFILE_GATE=1 PROFILE_RUNTIME=vllm SPARK_SELECTION=fixed-vllm)。

local-model profile 的运行时约束

NEMOCLAW_ENABLE_LOCAL_MODEL_PROFILE=1NEMOCLAW_LOCAL_MODEL_RUNTIME=vllm激活的是本地模型 profile 路径。在 src/lib/onboard/local-model-profile/plan.ts 中,LOCAL_MODEL_PROFILE_RUNTIME_ENV的合法取值目前只有vllm,并且 profile 计划还要求 recipe 满足:backend 为vllm、materializer 为vllm.host-local/v1、lifecycle 为vllm.host-local.lifecycle/v1——这保证了"固定 profile"路径只通过本机托管 vLLM 执行,不引入其他运行时。

两种方案共用的 Express 环境变量

无论用户选择方案一还是方案二,只要接受 Express,activate_express_install(scripts/install.sh)都会统一设置以下环境变量:

环境变量取值作用
NEMOCLAW_AGENT起始提示中已选的 Agent(openclaw / hermes / langchain-deepagents-code)锁定目标 Agent,不再重复询问
NEMOCLAW_NON_INTERACTIVE=11关闭安装器交互提示
NEMOCLAW_NON_INTERACTIVE_SUDO_MODE=promptprompt非交互模式下仍通过系统sudo安全收集管理员密码
NEMOCLAW_YES=11接受默认确认项
NEMOCLAW_POLICY_MODE=suggestedsuggested使用建议策略模式(默认 tier 为 balanced)
NEMOCLAW_ACCEPT_THIRD_PARTY_SOFTWARE=11接受已披露的第三方软件声明

同时,以下变量被显式保持未设置,让安装器应用剩余的 Express 默认值:

  • NEMOCLAW_SANDBOX_NAME(默认回退为my-assistant,见 scripts/install.sh);
  • NEMOCLAW_POLICY_TIER(默认balanced,披露为"suggested mode, tier 'balanced'",见 scripts/install.sh 与 test/installer-integration/install-express-prompt.test.ts);
  • web-search 设置与 messaging 设置。

一个重要的权限语义是:Express 确认本身即视为对已披露通知、下载与安装的批准,因此后续不再弹出最终许可提示;同时安装器也不会再次询问 Agent,也不会分别询问模型、沙箱名、web search、messaging、策略、下载批准或最终安装批准等问题。这也意味着整个安装以完全非交互方式推进(仅 sudo 按需提示),与 docs/resources/starter-prompt.md 中"收集完所有选择后再运行安装器、绝不让命令停在Choose [1]:"的约束一致。

安装完成后,需要向用户报告安装版本实际选中的模型

测试对完整导出结果的验证

安装器集成测试对两种方案的最终导出环境做了精确断言(test/installer-integration/install-express-prompt.test.ts 与 第232-233行):

方案一:RESULT NON_INTERACTIVE=1 SUDO_MODE=prompt PROVIDER=install-vllm MODEL= VLLM_MODEL= POLICY=suggested YES=1 SANDBOX=my-assistant STATION_EXPRESS= PROFILE_GATE= PROFILE_RUNTIME= SPARK_SELECTION=managed-vllm 方案二:RESULT NON_INTERACTIVE=1 SUDO_MODE=prompt PROVIDER= MODEL= VLLM_MODEL= POLICY=suggested YES=1 SANDBOX=my-assistant STATION_EXPRESS= PROFILE_GATE=1 PROFILE_RUNTIME=vllm SPARK_SELECTION=fixed-vllm

可以看到方案二通过PROFILE_GATE=1 PROFILE_RUNTIME=vllm激活 local-model profile,而方案一则走PROVIDER=install-vllm的托管 vLLM provider 路径,两者在环境导出上互斥且可区分。

Express 被拒绝后的常规 provider 选择

如果用户拒绝 Express(输入n或其他非确认值),安装器将回退到常规交互式 provider 选择流程(scripts/install.sh),并遵循 docs/resources/starter-prompt.md 中的 provider 菜单。对 DGX Spark 场景,常规流程会提供:

  • 已有 vLLM:当检测到localhost:${NEMOCLAW_VLLM_PORT:-8000}上有就绪服务时提供;
  • Managed vLLM:优化的本地推理,附带大体积下载;
  • 本地 Ollama:仅当所选 Agent 与平台支持时提供;
  • 所选 Agent 支持的全部托管或兼容 provider(NVIDIA Endpoints、OpenRouter、OpenAI、Anthropic、Gemini、Model Router、其他 OpenAI/Anthropic 兼容端点、Hermes Provider 等)。

常规流程下,非交互映射参考 starter prompt 的 provider 对照表(docs/resources/starter-prompt.md),例如 Managed vLLM 对应NEMOCLAW_PROVIDER=install-vllm、已有 vLLM 对应NEMOCLAW_PROVIDER=vllm

总结:DGX Spark Express 的关键决策路径

  1. 安装器通过固件 + FastOS 标记双重证据确认 DGX Spark;
  2. 询问两套推理方案:Managed vLLM 自动选型(默认)固定 Qwen3.6 35B-A3B NVFP4 catalog profile
  3. 披露推理摘要、边界、沙箱名与策略,展示第三方软件通知,再请求最终确认;
  4. 接受后统一导出NEMOCLAW_NON_INTERACTIVE=1NEMOCLAW_NON_INTERACTIVE_SUDO_MODE=promptNEMOCLAW_YES=1NEMOCLAW_POLICY_MODE=suggestedNEMOCLAW_ACCEPT_THIRD_PARTY_SOFTWARE=1,并按方案差异导出 provider 或 local-model profile 变量;
  5. 全程不再重复询问 Agent 与各类可选设置;安装完成后报告实际选中的模型;
  6. 拒绝 Express 则进入常规 provider 菜单,按需提供已有 vLLM、托管 vLLM、本地 Ollama 与托管/兼容 provider。

【免费下载链接】NemoClawRun agents like Hermes, LangChain Deep Agents, and OpenClaw more securely inside NVIDIA OpenShell with managed inference项目地址: https://gitcode.com/gh_mirrors/ne/NemoClaw

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询