# PR #34444 完整报告

- 仓库：`sgl-project/sglang`
- 标题：docs(cookbook): Kimi-K3 — drop --enable-symm-mem from the GB cells
- 合并时间：2026-08-12 03:23
- 原文链接：http://prhub.com.cn/sgl-project/sglang/pull/34444

---

## 执行摘要

本 PR 是一次小范围的文档修正，从 Kimi-K3 cookbook 的四个 GB 系列配置 cell 中移除 `--enable-symm-mem` 启动参数，影响面仅限文档命令示例，不涉及任何运行时代码或构建逻辑，风险很低。

## 功能与动机

PR body 明确说明：“Removes `--enable-symm-mem` from the four GB-series Kimi-K3 cells”，并列出 gb300 / unified / low-latency、gb200 / unified / low-latency、gb300 / prefill / default、gb300 / decode / low-latency 四个目标 cell。作者强调 B300、H200、H100 以及 AMD cell 保留该参数，且四个受影响 cell 原本就处于 `verificationStatus: "in-progress"`，因此不会改变任何已验证的部署声明。为什么仅对 GB 系列移除该参数，PR 中没有给出技术原因，推测与 GB 平台对称内存功能的可用性变化或推荐配置演进有关。

## 实现拆解

1. 定位变更入口：`docs/src/snippets/configs/moonshotai/kimi-k3.jsx` 以数组形式维护 Kimi-K3 各硬件形态的启动配置，每个 cell 由 `match: { hw, pdMode, strategy }` 标识，并在 `flags` 列表中给出完整命令行参数。
2. 删除参数：在四个 cell 的 `flags` 数组中各删除一行 `"--enable-symm-mem"`，分别是 gb300/unified/low-latency、gb200/unified/low-latency、gb300/prefill/default、gb300/decode/low-latency，其余参数保持不变。
3. 保留约束：B300、H200、H100 与 AMD 相关 cell 继续使用 `--enable-symm-mem`；§3.5 Low-HBM VLM 示例因为是通用单节点配置而非 GB 专属 recipe，也保持原样。
4. 配套验证：本 PR 仅改动一个 JSX 片段，没有新增测试；文档站点 CI 在 base 分支上通过，Extra 任务未触发。四个 cell 的 `verificationStatus` 原本为 `"in-progress"`，所以不会产生“已验证配置被悄悄修改”的问题。

### `docs/src/snippets/configs/moonshotai/kimi-k3.jsx`

唯一变更文件：从四个 GB 系列 Kimi-K3 配置 cell 中移除 --enable-symm-mem，同时保留 B300/H200/H100/AMD cell 与 §3.5 示例。

```jsx
// 以 gb300 / unified / low-latency 为例（变更后）：
// 本次 PR 从 flags 中移除了 "--enable-symm-mem"，
// 该参数在 GB 系列上不再需要，而 B300 / H200 / H100 与 AMD cell 仍保留。
{
  match: { hw: "gb300", pdMode: "unified", strategy: "low-latency" },
  nnodes: 2,
  verified: false,
  verificationStatus: "in-progress",
  env: [
    "SGLANG_ENABLE_TP_MEMORY_INBALANCE_CHECK=0",
  ],
  flags: [
    "--trust-remote-code",
    "--model-path {{MODEL_NAME}}",
    "--tp-size 8",
    "--mem-fraction-static 0.85",
    "--reasoning-parser kimi_k3",
    "--tool-call-parser kimi_k3",
    "--host {{HOST_IP}}",
    "--port {{PORT}}",
  ],
},

```

## 评论区精华

> 本 PR 没有任何 review 评论，唯一审核人 zijiexia 直接给出了 APPROVED，未留下任何意见。

因此没有可提炼的设计争论或未解决疑虑。

## 风险与影响

风险极低。唯一需要注意的是：如果 `--enable-symm-mem` 在部分 GB 配置中实际上仍是必要参数，按新文档操作的用户可能遇到与预期不同的显存或性能行为。不过这些 cell 都标注为 `in-progress`，且文档只是配置示例，不构成已验证承诺。另一个小风险是文档与运行时实际支持状态可能存在偏差，后续若该参数重新变回必需，需要同步更新文档。

影响范围：仅限文档站点中的 Kimi-K3 cookbook；对 SGLang 运行时、调度器、内核均无影响，对团队而言是一次普通的文档维护。

## 关联脉络

该 PR 属于持续进行的模型配置 cookbook 更新。历史 PR 中，#31105 处理了 Kimi-K2.7 在 AMD 平台上的 fp8 注意力修复，属于同一个 Kimi 模型系列的支撑工作；#34363 则为 Ling-3.0-flash 新增 INT4/MXFP4 部署 recipe，同样修改 `docs/src/snippets/configs` 下的 JSX 配置片段，体现了文档体系内以“平台 × 策略”单元格维护推荐命令的演进方向。