NemoClaw DGX Spark Express 安装指南:托管 vLLM 自动选型与固定 Qwen3.6 35B 推理方案解析

发布时间:2026/9/20 23:34:44
NemoClaw DGX Spark Express 安装指南:托管 vLLM 自动选型与固定 Qwen3.6 35B 推理方案解析 NemoClaw DGX Spark Express 安装指南托管 vLLM 自动选型与固定 Qwen3.6 35B 推理方案解析【免费下载链接】NemoClawRun agents like Hermes, LangChain Deep Agents, and OpenClaw more securely inside NVIDIA OpenShell with managed inference项目地址: https://gitcode.com/gh_mirrors/ne/NemoClaw本篇技术指南聚焦 NVIDIA NemoClaw 在DGX Spark硬件上的 Express 一键安装流程讲解安装器如何在硬件检测确认后提供两套 DGX Spark 推理配置托管 vLLM 自动 serving-profile 选型与固定 catalog-backed vLLM profile以及对应的全部环境变量语义与交互确认步骤。读完本文你将掌握 DGX Spark Express 安装的完整决策路径、可复现的非交互环境变量组合、两套推理方案各自的约束边界以及安装完成后如何验证实际生效的模型。适用前提仅在硬件检测确认 DGX Spark 后启用DGX Spark Express 指令有一个硬性前提只有在安装器硬件检测确认主机为 DGX Spark 之后才可使用。安装器不会仅凭 GPU 名称就判定机型而是综合产品、固件、架构与 GPU 证据做判定。在安装脚本 scripts/install.sh 中detect_express_platform()依次执行如下判定逻辑先判断是否为 Windows WSL 主机is_wsl_host再通过classify_dgx_station_hardware()读取固件身份DMI 优先、devicetree 兜底固件状态为spark时输出DGX Spark固件状态不明确时回退检查受信任的/etc/fastos-release标记spark_fastos_release_is_trusted其中对NAMEDGX SPARK FASTOS的读取过程做了严格的元数据完整性校验文件类型、属主、权限位、大小上界、内容校验防止路径替换或内容篡改。只有检测结果为DGX Spark时安装器才会进入 Express 提示流程其他平台DGX Station、N1x、Windows WSL、普通主机分别加载各自的平台指令资产。平台资产的加载入口定义在 docs/resources/starter-prompt.md其中明确读取匹配的原始 Markdown 文件全文并遵循它不得为其他电脑加载平台资产。Express 流程概览保持 Agent、默认选项、两种推理选择Express 安装的核心设计意图是保留用户已在起始提示starter prompt中选择的 Agent将可选配置全部留在默认值并针对 DGX Spark 提供两套推理设置。安装器只问最少的问题把其余决策全部交给预先定义好的非交互环境变量。在 scripts/install.sh 中select_spark_express_inference()向用户展示二选一菜单Choose the DGX Spark inference setup: 1) Managed vLLM with automatic serving-profile selection (default) 2) Qwen3.6 35B-A3B NVFP4 with the fixed catalog-backed vLLM profile Choose 1 or 2 [1]:两个选项分别是选项推理方案默认1Managed vLLM带自动 serving-profile 选择是直接回车或输入 12nvidia/Qwen3.6-35B-A3B-NVFP4使用固定的 catalog-backed vLLM profile否值得注意的是如果用户已经在环境中显式设置了NEMOCLAW_MODEL或NEMOCLAW_VLLM_MODELselect_spark_express_inference会直接返回、跳过这个菜单见 scripts/install.sh因为显式模型意图本身已经决定走哪条路径。用户做出选择后安装器通过describe_express_install完整披露本次安装将配置的推理摘要、边界说明、沙箱名与策略模式scripts/install.sh随后展示第三方软件通知再询问Run express install with these settings? [Y/n]:用户输入回车、y或yes视为接受其余输入视为拒绝并回退到常规交互式 provider 选择流程scripts/install.sh。方案一Managed vLLM 自动 serving-profile 选择默认当用户选择选项 1 时activate_express_install对 DGX Spark 分支执行如下环境变量配置scripts/install.sh设置NEMOCLAW_PROVIDERinstall-vllm保持NEMOCLAW_ENABLE_LOCAL_MODEL_PROFILE、NEMOCLAW_LOCAL_MODEL_RUNTIME、NEMOCLAW_MODEL、NEMOCLAW_VLLM_MODEL全部未设置其中前两个被显式unset若用户在环境中显式提供了NEMOCLAW_VLLM_MODEL则保留并透传该值显式模型保持权威性。自动选型原理install-vllm这一 provider 值对应安装并托管 vLLM 服务后端的 onboarding 分支。在 src/lib/inference/serving/profile-list.ts 中servingBackendProviderKey()将vllm后端映射为install-vllmprovider保证列表里展示的每个兼容 profile 都有可执行的 provider 来运行它。在没有任何显式推理意图或相关运行时的情况下安装器会从 serving catalog 中选取恰好一个经过资质认证的预信任托管集群拓扑匹配对应的钉死pinned分布式 profile若普通无匹配情况则沿用既有的单主机 DGX Spark profile。任何相关或模糊的已有设置都会让安装停止而不是被覆盖。describe_express_install中的披露原文明确指出scripts/install.shWith no explicit inference intent or related runtime, one exactly qualified pretrusted managed cluster topology selects a matching pinned distributed profile. An ordinary no-match keeps the existing single-host DGX Spark profile; any related or ambiguous setup remains untouched and stops installation.profile 的自动选择基于 preset 的selection: automatic与priority排序结合每节点 readiness 检查平台资质、Docker 可用性、GPU 可用性等过滤出兼容项兼容性评估逻辑见 src/lib/inference/serving/profile-list.ts。显式模型时的行为差异若设置了NEMOCLAW_VLLM_MODEL披露为 managed local vLLM with model …保留既有单主机 DGX Spark profile管理式 vLLM 仅拉取配置的镜像/模型并运行专用容器若只设置了NEMOCLAW_MODEL披露为 managed local vLLM with explicit model intent …走可定制的 managed-vLLM 路径且不再提供固定 profile 选项。安装器集成测试 test/installer-integration/install-express-prompt.test.ts 验证了显式NEMOCLAW_VLLM_MODELcustom-qwen3.6时导出结果为PROVIDERinstall-vllm MODEL VLLM_MODELcustom-qwen3.6而显式NEMOCLAW_MODELcatalog/model时导出MODELcatalog/model VLLM_MODEL且不出现固定 profile 菜单。方案二固定 catalog-backed vLLM profileQwen3.6 35B-A3B NVFP4当用户选择选项 2 时activate_express_install对 DGX Spark 分支执行如下环境变量配置scripts/install.sh设置NEMOCLAW_ENABLE_LOCAL_MODEL_PROFILE1与NEMOCLAW_LOCAL_MODEL_RUNTIMEvllm保持NEMOCLAW_PROVIDER、NEMOCLAW_MODEL、NEMOCLAW_VLLM_MODEL、NEMOCLAW_VLLM_EXTRA_ARGS_JSON全部未设置保留用户已有的NEMOCLAW_VLLM_PORT主机端口覆盖。该方案由 serving catalog 全权决定固定模型、运行时镜像、容器端口与 vLLM 参数。固定的模型为nvidia/Qwen3.6-35B-A3B-NVFP4对应的 preset 定义在 managed-inference/presets/vllm.dgx-spark-gb10.single.qwen3-6-35b-a3b-nvfp4.yaml其supportState: supported、验证级别为hardware证据preexisting-supported-profile-v0.0.109通过host.platform.dgx_spark资质与 Docker 就绪等条件参与自动选择。覆盖保护的强制约束固定 profile 路径对用户覆盖实施严格拒绝策略。activate_express_install中若检测到NEMOCLAW_PROVIDER、NEMOCLAW_MODEL、NEMOCLAW_VLLM_MODEL或NEMOCLAW_VLLM_EXTRA_ARGS_JSON任一被设置会直接报错并中止The fixed DGX Spark vLLM profile does not accept provider, model, or serve-argument overrides.这一约束有两层防线见 scripts/install.sh 与披露文本 scripts/install.sh安装器层面拒绝 provider / model / serve-argument 覆盖专用 local-model onboarder 层面在启动托管容器前拒绝 vLLM model 与 serve-argument 覆盖。而NEMOCLAW_VLLM_PORT是唯一被允许的例外——它只用于覆盖主机侧监听端口。测试 test/installer-integration/install-express-prompt.test.ts 同时验证了两点设置NEMOCLAW_VLLM_EXTRA_ARGS_JSON[--max-model-len,4096]时安装被拒绝且不导出任何结果环境变量而设置NEMOCLAW_VLLM_PORT18000时安装正常继续PROFILE_GATE1 PROFILE_RUNTIMEvllm SPARK_SELECTIONfixed-vllm。local-model profile 的运行时约束NEMOCLAW_ENABLE_LOCAL_MODEL_PROFILE1与NEMOCLAW_LOCAL_MODEL_RUNTIMEvllm激活的是本地模型 profile 路径。在 src/lib/onboard/local-model-profile/plan.ts 中LOCAL_MODEL_PROFILE_RUNTIME_ENV的合法取值目前只有vllm并且 profile 计划还要求 recipe 满足backend 为vllm、materializer 为vllm.host-local/v1、lifecycle 为vllm.host-local.lifecycle/v1——这保证了固定 profile路径只通过本机托管 vLLM 执行不引入其他运行时。两种方案共用的 Express 环境变量无论用户选择方案一还是方案二只要接受 Expressactivate_express_installscripts/install.sh都会统一设置以下环境变量环境变量取值作用NEMOCLAW_AGENT起始提示中已选的 Agentopenclaw / hermes / langchain-deepagents-code锁定目标 Agent不再重复询问NEMOCLAW_NON_INTERACTIVE11关闭安装器交互提示NEMOCLAW_NON_INTERACTIVE_SUDO_MODEpromptprompt非交互模式下仍通过系统sudo安全收集管理员密码NEMOCLAW_YES11接受默认确认项NEMOCLAW_POLICY_MODEsuggestedsuggested使用建议策略模式默认 tier 为 balancedNEMOCLAW_ACCEPT_THIRD_PARTY_SOFTWARE11接受已披露的第三方软件声明同时以下变量被显式保持未设置让安装器应用剩余的 Express 默认值NEMOCLAW_SANDBOX_NAME默认回退为my-assistant见 scripts/install.shNEMOCLAW_POLICY_TIER默认balanced披露为suggested mode, tier balanced见 scripts/install.sh 与 test/installer-integration/install-express-prompt.test.tsweb-search 设置与 messaging 设置。一个重要的权限语义是Express 确认本身即视为对已披露通知、下载与安装的批准因此后续不再弹出最终许可提示同时安装器也不会再次询问 Agent也不会分别询问模型、沙箱名、web search、messaging、策略、下载批准或最终安装批准等问题。这也意味着整个安装以完全非交互方式推进仅 sudo 按需提示与 docs/resources/starter-prompt.md 中收集完所有选择后再运行安装器、绝不让命令停在Choose [1]:的约束一致。安装完成后需要向用户报告安装版本实际选中的模型。测试对完整导出结果的验证安装器集成测试对两种方案的最终导出环境做了精确断言test/installer-integration/install-express-prompt.test.ts 与 第232-233行方案一RESULT NON_INTERACTIVE1 SUDO_MODEprompt PROVIDERinstall-vllm MODEL VLLM_MODEL POLICYsuggested YES1 SANDBOXmy-assistant STATION_EXPRESS PROFILE_GATE PROFILE_RUNTIME SPARK_SELECTIONmanaged-vllm 方案二RESULT NON_INTERACTIVE1 SUDO_MODEprompt PROVIDER MODEL VLLM_MODEL POLICYsuggested YES1 SANDBOXmy-assistant STATION_EXPRESS PROFILE_GATE1 PROFILE_RUNTIMEvllm SPARK_SELECTIONfixed-vllm可以看到方案二通过PROFILE_GATE1 PROFILE_RUNTIMEvllm激活 local-model profile而方案一则走PROVIDERinstall-vllm的托管 vLLM provider 路径两者在环境导出上互斥且可区分。Express 被拒绝后的常规 provider 选择如果用户拒绝 Express输入n或其他非确认值安装器将回退到常规交互式 provider 选择流程scripts/install.sh并遵循 docs/resources/starter-prompt.md 中的 provider 菜单。对 DGX Spark 场景常规流程会提供已有 vLLM当检测到localhost:${NEMOCLAW_VLLM_PORT:-8000}上有就绪服务时提供Managed vLLM优化的本地推理附带大体积下载本地 Ollama仅当所选 Agent 与平台支持时提供所选 Agent 支持的全部托管或兼容 providerNVIDIA Endpoints、OpenRouter、OpenAI、Anthropic、Gemini、Model Router、其他 OpenAI/Anthropic 兼容端点、Hermes Provider 等。常规流程下非交互映射参考 starter prompt 的 provider 对照表docs/resources/starter-prompt.md例如 Managed vLLM 对应NEMOCLAW_PROVIDERinstall-vllm、已有 vLLM 对应NEMOCLAW_PROVIDERvllm。总结DGX Spark Express 的关键决策路径安装器通过固件 FastOS 标记双重证据确认 DGX Spark询问两套推理方案Managed vLLM 自动选型默认或固定 Qwen3.6 35B-A3B NVFP4 catalog profile披露推理摘要、边界、沙箱名与策略展示第三方软件通知再请求最终确认接受后统一导出NEMOCLAW_NON_INTERACTIVE1、NEMOCLAW_NON_INTERACTIVE_SUDO_MODEprompt、NEMOCLAW_YES1、NEMOCLAW_POLICY_MODEsuggested、NEMOCLAW_ACCEPT_THIRD_PARTY_SOFTWARE1并按方案差异导出 provider 或 local-model profile 变量全程不再重复询问 Agent 与各类可选设置安装完成后报告实际选中的模型拒绝 Express 则进入常规 provider 菜单按需提供已有 vLLM、托管 vLLM、本地 Ollama 与托管/兼容 provider。【免费下载链接】NemoClawRun agents like Hermes, LangChain Deep Agents, and OpenClaw more securely inside NVIDIA OpenShell with managed inference项目地址: https://gitcode.com/gh_mirrors/ne/NemoClaw创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考