news 2026/9/20 15:52:01

NemoClaw DGX Station Express 安装实战:Nemotron 3 Ultra 550B 与 DeepSeek V4 Flash 一键部署与边界约束

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
NemoClaw DGX Station Express 安装实战:Nemotron 3 Ultra 550B 与 DeepSeek V4 Flash 一键部署与边界约束

NemoClaw DGX Station Express 安装实战:Nemotron 3 Ultra 550B 与 DeepSeek V4 Flash 一键部署与边界约束

【免费下载链接】NemoClawRun agents like Hermes, LangChain Deep Agents, and OpenClaw more securely inside NVIDIA OpenShell with managed inference项目地址: https://gitcode.com/gh_mirrors/ne/NemoClaw

DGX Station Express 是 NemoClaw 为单台或成对 DGX Station GB300 提供的精简引导流程:安装器在完成硬件与软件资格判定后,向操作员提供「Nemotron 3 Ultra 550B 自动配对」与「DeepSeek V4 Flash」两个受维护的推理选项,并统一负责主机准备、第三方软件同意、建议网络策略、默认沙箱与重启/登录后续恢复。读完本文,你将掌握 Express 的资格判定规则、--force-station-install的验证专用语义、两条安装路径的底层模型与配方映射,以及哪些环境变量必须保持未设置、哪些操作必须交由安装器独占执行。

本文对应仓库文档 docs/resources/prompt-assets/dgx-station.md,并以 scripts/install.sh、scripts/prepare-dgx-station-host.sh 与 managed-inference/recipes 下的实际实现为佐证。

何时使用这些指令:硬件检测先行

DGX Station Express 指令仅在硬件检测确认目标机器是 DGX Station 之后才允许使用。也就是说,Express 流程不是用户自由选择的入口,而是安装器完成平台识别后的条件分支——检测到非 Station 平台时,相关标志会被直接拒绝(见下文「标志互斥与校验」)。

在向操作员提供 Station Express 选项之前,安装器必须先完成Station 软件资格检查。资格判定由安装器调用 scripts/prepare-dgx-station-host.sh 中的classify_dgx_station_release逻辑完成,分类结果包括:

  • generic-ubuntu:通用 Ubuntu 镜像;
  • supported-dgx-os:受支持的 DGX OS(OTA 形式);
  • supported-colossus-baseos:受支持的 Colossus BaseOS;
  • supported-ai-developer-tools:受支持的 AI Developer Tools 镜像。

对应地,scripts/install.sh 中的 Express 元数据边界明确接受以下发布形态(见install.sh中 "Unsupported DGX Station OS" 的报错文本):通用 Ubuntu 24.04 ARM64、OTA 形式的 DGX OS 7.2.0 / 7.4.0 / 7.5.0、无 OTA 的 DGX OS 7.6.x 系列,或经过显式合格认证的 Station 出厂镜像。DGX_PRETTY_NAME仅用于诊断,不决定资格结论。

软件资格未通过时的处理:验证专用的 --force-station-install

硬件合格但软件资格未通过时,不得继续走 Express 的正常选项,而应:

  1. 向操作员说明:当前发布档案(release profile)阻断了 Station Express 引导,也阻断了直接 GPU 策略(direct-GPU policy)的创建;
  2. 仅在一种情况下提供--force-station-install确属真实的 Station GB300 硬件,但发布元数据未被识别,此时它是文档化的、验证专用(validation-only)的恢复路径;
  3. 说明验证专用处理的语义:保留出厂软件栈不运行引导(onboarding)不选择模型,退出并给出「安装受支持的 DGX Station 软件档案」的指引。

在验证专用处理完成之后,流程必须停止:操作员需要先安装受支持的软件档案,之后才能不带--force-station-install重新运行普通安装器。验证专用模式绝不会“顺便”进入 Express 的模型选择——--force-station-install的校验函数validate_force_station_install_override(位于 scripts/install.sh)会强制以下互斥约束:

  • 不能与--station-deepseekNEMOCLAW_VLLM_MODELNEMOCLAW_MODEL组合(它是验证专用,不做任何模型选择覆盖);
  • 平台必须检测为 DGX Station GB300(PCI 厂商0x10de、设备0x31c2/0x31c3,见 scripts/prepare-dgx-station-host.sh 顶部的GB300_PCI_*常量);
  • 若发布状态已属于受支持分类(generic-ubuntu / supported-dgx-os / supported-colossus-baseos / supported-ai-developer-tools),则报错并提示移除该标志;
  • 不能与NEMOCLAW_NO_EXPRESS=1、非交互模式(含由NON_INTERACTIVE_SOURCE触发的间接非交互)或NEMOCLAW_PROVIDER组合;
  • 需要交互终端(express_prompt_can_read_tty检查,失败时调用fail_force_station_terminal_required报错,提示 curl|bash 管道必须可用/dev/tty)。

只有软件资格通过的 Station,才继续进入下方 Express 选择流程,并由安装器做最终的运行时与准备决策。

安装器权威原则:不要绕过 Express 分支

Express 流程遵循一条铁律:以所选维护版本官方安装器的行为为唯一权威,覆盖 Station 资格、主机准备、模型选择、同意确认以及重启/登录后的恢复。因此:

  • 不要单独运行 Station 准备辅助脚本(scripts/prepare-dgx-station-host.sh)来代替安装器的内置准备;
  • 不要通过预先设置 provider 与 model 环境变量来“复刻”Express 效果——这类变量在 Express 分支中是被明确禁止设置的(见下文)。

两个 Station Express 选项

安装器提供两个 Express 选项,二者共用同一套 Station 检测、主机准备、同意、建议策略、默认沙箱与修订版(revision)恢复流程:

  1. 自动配对选择(默认路径):普通安装器选择nemotron-3-ultra-550b-a55b,并检测两条已配置的私有/30ConnectX-8 网轨(rail)的确定性对端上是否已有一个已被信任的对等节点(peer)。若找到合格配对,则使用 vLLM 0.25.1 + Ray 2.56.0 的双 Station 配方,以nemotron-ultra名义提供服务;否则保留单 Station Ultra 配方,以nvidia/nemotron-3-ultra-550b-a55b名义提供服务。install.sh中的对应常量如下:

    • STATION_ULTRA_VLLM_MODEL="nemotron-3-ultra-550b-a55b"
    • STATION_ULTRA_SERVED_MODEL="nvidia/nemotron-3-ultra-550b-a55b"
    • STATION_ULTRA_DUAL_SERVED_MODEL="nemotron-ultra"
    • STATION_ULTRA_LEGACY_VLLM_IMAGE="vllm/vllm-openai@sha256:0fec7ec5f3e6bc168e54899935fb0557da908a4832a1dbc88e2debcf2f889416"

    单机场景的运行时清单可在 managed-inference/recipes/vllm.nemotron-3-ultra-550b-a55b-nvfp4.station-arm64-single.v1.yaml 中查看:该 ServingRecipe 使用与上述一致的 vLLM 镜像(约 10.67 GB 镜像下载)、architecture: arm64gpuRequest: all,并注入VLLM_WEIGHT_OFFLOADING_DISABLE_PIN_MEMORY=1VLLM_NVFP4_GEMM_BACKEND=flashinfer-trtllm两个运行时环境变量,对应模型清单见 managed-inference/models/vllm.nemotron-3-ultra-550b-a55b-nvfp4.v1.yaml。

  2. DeepSeek V4 Flash(显式覆盖):通过--station-deepseek标志选择deepseek-v4-flash,以deepseek-ai/DeepSeek-V4-Flash名义提供服务。install.sh中的对应常量为STATION_DEEPSEEK_VLLM_MODEL="deepseek-v4-flash"STATION_DEEPSEEK_SERVED_MODEL="deepseek-ai/DeepSeek-V4-Flash"

--station-deepseek的校验函数validate_station_deepseek_override同样有硬性约束:平台必须检测为 DGX Station;不能与NEMOCLAW_NO_EXPRESS=1、非交互模式或NEMOCLAW_PROVIDER组合;NEMOCLAW_VLLM_MODEL若被设置,只能等于deepseek-v4-flash或其别名deepseek-ai/deepseek-v4-flash;并且必须运行在交互终端中(curl|bash 管道需要/dev/tty可用),否则调用fail_station_deepseek_terminal_required直接失败。

同意前必须说明的边界

在征得操作员同意之前,必须逐条说明以下边界,缺一不可:

  • 通用 Ubuntu 上的包变更:在通用 Ubuntu 上,Express 可能安装或更改固定的 NVIDIA 开源驱动、Docker 与 Buildx、NVIDIA Container Toolkit,以及经过审核的出厂dkms过渡;在合格出厂镜像上,安装器走有界验证与修复路径,而不是替换出厂软件栈。
  • docker 组成员权限:官方 Station 准备可能把受信任的本地账户加入docker组,这等同于授予 root 级控制权,只适合受信任的单用户开发主机。
  • 重启与恢复:官方 Station 准备可能需要操作员控制的重启,且恢复时只接受已被认可的 NemoClaw 修订版。prepare-dgx-station-host.sh用退出码表达这一流程:--apply返回退出码10表示需要操作员控制的重启,重启后再次运行--apply再运行--verify;退出码11表示已加入 docker 组,需新开登录会话后再次运行--apply,无需重启;退出码12表示已有 vLLM 工作负载需要安装器做所有权选择。
  • 网络责任划分:NemoClaw配置两条私有网轨、不扫描网络、不建立 SSH 信任、也不重启任何一台 Station;物理隔离、防火墙、SSH 信任与手动重启全部由操作员负责。
  • 双站运行时信任前提:双 Station 运行时使用未经认证的 Ray、NCCL 与 vLLM 协调流量,包括 TCP 端口6379上的 Ray head 与 Ray worker 流量。因此两台 Station 以及任何能触达任一条网轨的主机必须互相信任;共享的/24网段不等价于所需的直连私有/30网轨。
  • 磁盘空间:Nemotron Ultra Express 需要下载约352 GB的模型数据;DeepSeek Express 下载其固定的 vLLM 容器与模型数据。两者都要求模型缓存文件系统与 Docker 存储有足够空间。
  • 测试边界:DGX Station 仅在一台物理 DGX Station GB300上、跨合格档案做过带限制的测试;双 Station 配置尚未经过验证,也没有专属 CI 覆盖

交互式询问与三个选择

安装器以固定提问开始:“Which DGX Station Express option would you like?”(您希望使用哪个 DGX Station Express 选项?),备选:

  1. 自动配对选择:使用 Nemotron 3 Ultra 550B——存在合格且受信任的对等节点时用双站配方,否则用单站 Ultra 配方;
  2. DeepSeek V4 Flash:显式--station-deepseek覆盖;
  3. 都不是:按正常方式自行选择运行时与模型。

提问必须保持可见、可应答,安装器随后展示的第三方软件通知与 Express 总结也必须逐条保留,等待操作员响应,不得预先应答或压制。

选中 Express 模型后的执行规则

一旦操作员选择了 Express 模型,以下规则必须严格执行:

  • 设置NEMOCLAW_AGENT为 starter prompt 中已选定的 agent(如 hermes、LangChain Deep Agents 或 OpenClaw 之一)。
  • 自动配对选择:运行不带--station-deepseek的普通安装器;除非用户已预先选定受信任的对等节点,否则不要主动提供 peer;若提供了显式 peer,则该 peer 必须通过资格校验,否则 setup 停止,而不是回退到单站。
  • DeepSeek:传入--station-deepseek,且不带任何其他模型选择覆盖。
  • 以下环境变量一律不得设置NEMOCLAW_PROVIDERNEMOCLAW_VLLM_MODELNEMOCLAW_MODELNEMOCLAW_NON_INTERACTIVENEMOCLAW_YESNEMOCLAW_ACCEPT_THIRD_PARTY_SOFTWARENEMOCLAW_NO_EXPRESS
  • 保持未设置NEMOCLAW_SANDBOX_NAMENEMOCLAW_POLICY_TIER、web 搜索设置与消息通道设置,让安装器应用其 Express 默认值(建议策略、默认沙箱)。
  • 不要单独运行scripts/prepare-dgx-station-host.sh 的--check--verify--apply:Station 资格与准备由安装器独占负责。
  • 只在安全的交互终端运行安装器。如果编码代理 UI 无法保持安装器提示可见并接收操作员响应,应在安装前停止。
  • 让安装器自行展示第三方软件通知与 Express 总结,每个官方确认项保持可见,等待操作员响应,不预先应答、不抑制。
  • 不传--force-station-install,除非安装器在真实 Station GB300 硬件上拒绝了发布元数据,且操作员另行选择了文档化的临时覆盖。
  • 遵守安装器在必需重启或登录过渡后打印的命令,按其指引继续。
  • 描述 Ultra 时称其为普通 Express 选择;分布式双站拓扑只有在安装器报告「对端 Station、GPU、网轨、MAC、路由、邻居与巨帧(jumbo-frame)检查均合格」之后,才可描述为已选定。

关于对端配对的细节,scripts/install.sh 在双站分支中打印Checking for one pretrusted reciprocal dual-DGX Station peer on the two direct /30 rail counterparts.,并在发现「完整运行中的 NemoClaw 托管双站 head」或「正在运行的旧版单站 Ultra head」时分别延迟主机准备(_STATION_EXPRESS_DEFERRED_MANAGED_PAIR/_STATION_EXPRESS_MIGRATING_LEGACY_HEAD),交由后续协调器重新验证互惠物理配对后再复用既有生命周期——这印证了「显式 peer 必须合格,不合格即停止而非回退」的实现语义。

拒绝 Express 后的正常选择流程

如果操作员选择「都不是」(选项 3),安装器继续正常的 provider 选择流程

  • 检测到已就绪的 vLLM 服务时,提供既有 vLLM
  • 提供托管 vLLM(managed vLLM)
  • 提供受支持的本地 Ollama
  • 提供所选 agent 支持的全部托管或兼容 provider

更多资源

  • 安装器入口与全部标志、环境变量说明:scripts/install.sh(--station-deepseek--force-station-installNEMOCLAW_NO_EXPRESS=1NEMOCLAW_ACCEPT_THIRD_PARTY_SOFTWARE=1等);
  • Station 主机准备辅助脚本(安装器内部使用,含--check/--apply/--verify/--bind-controller与退出码语义):scripts/prepare-dgx-station-host.sh;
  • 单站 Ultra 运行时配方:managed-inference/recipes/vllm.nemotron-3-ultra-550b-a55b-nvfp4.station-arm64-single.v1.yaml;
  • 双站 vLLM 集群实现与测试:src/lib/inference/vllm-station-cluster.ts、src/lib/inference/vllm-dual-station.test.ts;
  • 平台身份探测:src/lib/inference/dgx-station-identity.ts;
  • 完整上手与双站指南:docs/get-started/dgx-station-preparation.mdx、docs/inference/set-up-vllm-on-two-dgx-stations.mdx、docs/inference/set-up-vllm.mdx。

【免费下载链接】NemoClawRun agents like Hermes, LangChain Deep Agents, and OpenClaw more securely inside NVIDIA OpenShell with managed inference项目地址: https://gitcode.com/gh_mirrors/ne/NemoClaw

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/20 15:51:44

微型纯电车操作指南:充电逻辑、电子换挡与隐藏功能详解

简介:天琴YOUNG光小新S400/L400车型的官方使用手册电子版,专为车主和售后服务人员编写,系统涵盖整车操作图解、驾驶指南、质保权益及安全维护说明。资源为单份PDF文档,约18.93MB,章节结构清晰,便于按需查阅…

作者头像 李华
网站建设 2026/9/20 15:50:51

基于时空风险场的自动驾驶预测轨迹规划方法

简介:这是一份面向自动驾驶科研人员与算法工程师的英文PDF论文,聚焦动态道路环境下的车辆轨迹规划难题。研究提出基于时空风险势场的混合规划方法,通过并行处理候选轨迹生成与风险评估,结合交互多模型预测周围车辆车道概率&#x…

作者头像 李华
网站建设 2026/9/20 15:48:43

FreeRTOS测试框架实战指南:3步跑通内核级嵌入式测试

FreeRTOS测试框架实战指南:3步跑通内核级嵌入式测试 【免费下载链接】FreeRTOS Classic FreeRTOS distribution. Started as Git clone of FreeRTOS SourceForge SVN repo. Submodules the kernel. 项目地址: https://gitcode.com/GitHub_Trending/fr/FreeRTOS …

作者头像 李华
网站建设 2026/9/20 15:47:55

初级消防证备考:题库考点逻辑与实操技巧全解析

简介:这份初级消防证试题题库及答案以Word文档形式整理,共包含选择题30余道,覆盖火警电话、火灾预防、初起火灾扑救、逃生方法、灭火器使用、电气火灾处理、易燃易爆物品管理等消防基础知识点,适合备考初级消防设施操作员或参加消…

作者头像 李华
网站建设 2026/9/20 15:46:57

Revit模型转glTF/glb:BIM到Web可视化的高效导出指南

简介:Revit2glTF是一个面向Autodesk Revit的开源glTF导出器,主要服务于BIM模型轻量化与Web三维可视化场景,帮助Revit二次开发人员借助API将模型数据转换为glTF格式。项目目前处于开发早期,整体框架已经建立,后续待办包…

作者头像 李华