Prhub

#31610 docs(cookbook): replace pinned nightly/dev images with :latest

原始 PR 作者 dougyster 合并时间 2026-07-18 07:33 文件变更 15 提交数 5 评论 1 代码增减 +47 / -71

执行摘要

将 cookbook 中固定的 nightly/dev 镜像替换为 :latest

PR描述中提到:许多cookbook页面仍然固定了nightly或模型/PR特定的dev Docker镜像(如nightly-dev-DATE-shadev-<model>等)。这些镜像随着nightly被清理和dev标签轮转而腐烂,导致读者的docker pull失败。此次将它们改为稳定的lmsysorg/sglang:latest

建议合并该PR,因为它修复了读者操作失败的问题,清理了过时文档内容。但需要关注PR body中提到的验证清单,确保相关模型在:latest上可以加载。对于设计决策,值得关注的是统一标签策略和明确保留哪些范围,以及处理Nemotron3-Ultra时的权衡过程。

讨论亮点

该PR没有引发公开review评论,只有一个approval。但在commit历史中,Nemotron3-Ultra的标签经历了三次反复:先是替换为:latest(首次提交),然后改为:dev(第二次提交,因为担心新版支持未合入),最后又改回:latest(第五次提交,与#31094对齐)。最终决策依据是#28309是一个性能优化,不影响模型支持,因此:latest已足够。

实现拆解

步骤:

  1. 在三个核心snippets配置文件中(laguna-m1.jsx、minimax-m3.jsx、laguna-xs21.jsx)将dockerImages对象中的各GPU变体标签从dev/nightly替换为lmsysorg/sglang:latest,同步更新注释消除CUDA变体说明。
  2. 在13个cookbook mdx页面中(如Gemma4、Hunyuan3-Preview、Ling-2.5-1T等)将Docker拉取命令和镜像表格中的特定标签替换为:latest,简化表格行数合并多架构描述。
  3. 针对Nemotron3-Ultra页面经历了三次提交:先从:dev改为:latest,再改为:dev,最后又改回:latest,以与#31094保持一致,确认#28309是性能优化但支持已在稳定版本中。
  4. 明确保留不更改的范围:rolling dev标签、固定稳定版本标签(v0.5.x)、ROCm镜像、benchmark来源记录以及Inkling页面。
  5. 没有添加测试,但PR body指出需要在:latest上对几个模型进行加载验证。
文件 模块 状态 重要度
docs_new/src/snippets/configs/poolside/laguna-m1.jsx 配置片段 modified 5.93
docs_new/src/snippets/configs/MiniMaxAI/minimax-m3.jsx 配置片段 modified 5.92
docs_new/src/snippets/configs/poolside/laguna-xs21.jsx 配置片段 modified 5.27
docs_new/cookbook/autoregressive/Google/Gemma4.mdx 菜谱文档 modified 3.05
docs_new/cookbook/autoregressive/Tencent/Hunyuan3-Preview.mdx 菜谱文档 modified 2.99

关键源码片段

docs_new/src/snippets/configs/poolside/laguna-m1.jsx documentation-update

核心配置文件之一,包含 5 个 GPU 变体的 dockerImages 映射。替换前使用固定的 nightly 镜像(dev-cu13-618-nightly),现统一为 :latest,并更新注释说明。

// 之前这里使用了固定的 nightly 镜像(如 `dev-cu13-618-nightly`),
// 现在替换为稳定的 `:latest` 标签,覆盖 H200 和所有 Blackwell GPU。
dockerImages: {
  h200: "lmsysorg/sglang:latest",
  b200: "lmsysorg/sglang:latest",
  b300: "lmsysorg/sglang:latest",
  gb200: "lmsysorg/sglang:latest",
  gb300: "lmsysorg/sglang:latest",
},
docs_new/src/snippets/configs/MiniMaxAI/minimax-m3.jsx documentation-update

核心配置文件,包含 6 个 GPU 变体的 dockerImages 映射。替换前每个架构使用不同 dev 镜像(如 dev-minimax-m3、dev-cu13-minimax-m3 等),现统一为 :latest,并保留 AMD ROCm 部分不变。

// 之前每个 GPU 架构使用不同的 dev 镜像(如 `dev-minimax-m3`、`dev-cu13-minimax-m3` 等),
// 现在统一使用 `:latest`(cu13,多架构),覆盖 H200 + 所有 Blackwell。
// AMD ROCm 镜像保持不变(因为无 `:latest` 等价物)。
dockerImages: {
  b200: "lmsysorg/sglang:latest",
  b300: "lmsysorg/sglang:latest",
  gb200: "lmsysorg/sglang:latest",
  gb300: "lmsysorg/sglang:latest",
  h200: "lmsysorg/sglang:latest",
  mi300x: "aigmkt/minimax-m3-sglang-rocm700-mi30x",
  mi325x: "aigmkt/minimax-m3-sglang-rocm700-mi30x",
  mi350x: "aigmkt/minimax-m3-sglang-rocm720-mi35x",
  mi355x: "aigmkt/minimax-m3-sglang-rocm720-mi35x",
},
docs_new/src/snippets/configs/poolside/laguna-xs21.jsx documentation-update

核心配置文件,包含 3 个 GPU 变体的 dockerImages 映射。替换前使用专用 dev 镜像(dev-cu13-laguna-xs-2-1),现为 :latest。

// 之前使用专用的 dev 镜像(`dev-cu13-laguna-xs-2-1`),
// 现在替换为 `:latest`,因为该构建已合并到稳定版本中。
dockerImages: {
  h200: "lmsysorg/sglang:latest",
  b300: "lmsysorg/sglang:latest",
  gb300: "lmsysorg/sglang:latest",
},

评论区精华

没有提炼出高价值讨论线程

当前评论区没有形成足够清晰的争议点或结论,后续有更多讨论时会体现在这里。

风险与影响

主要风险是部分模型(如Nemotron3-Ultra、MiniMax-M3等)的特定支持可能在:latest中尚未完全就绪,读者使用cookbook中的命令会因镜像不包含所需模型代码而失败。PR body已经列出了需要验证的模型列表(Nemotron3-Ultra、MiniMax-M3、Qwen3.6、Step3.5等)。另外,如果未来有新的模型需要不同的镜像环境,统一使用:latest可能引入兼容性问题。但整体风险较低,因为:latest应该始终包含main分支的最新稳定代码。

对用户的影响:简化了部署步骤,无需查找和拉取特定nightly镜像,减少失败几率。对系统无影响。对文档维护者:减少了过时标签的维护负担,但需要确保模型支持合入:latest。影响范围是使用cookbook部署模型的读者,特别是涉及文中所列模型的用户,需要确认镜像有效性。

模型支持尚未合入 latest 的风险 缺少运行验证

关联 Issue

未识别关联 Issue

当前没有检测到明确关联的 Issue 链接,后续同步到相关引用后会出现在这里。

完整报告

参与讨论