#27198 docs: add SANA-WM diffusion cookbook
原始 PR · 作者 AgainstEntropy · 合并时间 2026-06-09 10:47
添加 SANA-WM 扩散模型 cookbook
对于技术管理者,此 PR 表明团队在完善扩散模型文档生态,值得关注。对于需要使用 SANA-WM 的工程师,此 cookbook 是权威参考,建议精读。对于文档维护者,需注意实时配置的及时更新。
SGLang is a high-performance serving framework for large language models and multimodal models.
原始 PR · 作者 AgainstEntropy · 合并时间 2026-06-09 10:47
添加 SANA-WM 扩散模型 cookbook
对于技术管理者,此 PR 表明团队在完善扩散模型文档生态,值得关注。对于需要使用 SANA-WM 的工程师,此 cookbook 是权威参考,建议精读。对于文档维护者,需注意实时配置的及时更新。
原始 PR · 作者 janbernloehr · 合并时间 2026-06-09 10:43
修复 PCG warmup 因 context_length 过小导致的崩溃
这是针对关键启动崩溃的最小化修复,值得精读以理解 PCG 配置与 context-length 的耦合。建议在 #30206 落地后确认最终方案。
原始 PR · 作者 Kangyan-Zhou · 合并时间 2026-06-09 09:53
给实验性路由器添加 /flush_cache 端点
值得精读。该 PR 实现清晰,设计决策明确(如绕过断路器、并发限制、错误报告格式)。对于需要扩展类似管理端点的开发者,是很好的参考。
为 Intel XPU 添加 xpu_attn 多模态编码器注意力后端
该 PR 值得详细阅读,尤其关注 `resolve_max_seqlen` 的缓存设计和 XPU 后端的注册流程。建议在合并前确认 `sgl_kernel.flash_attn.flash_attn_varlen_func` 对 `window_size` 和 `sinks` 的支持情况,并考虑增加更完善的测试覆盖。
在Intel XPU上启用Nemotron-3-Nano混合Mamba+MoE模型
此 PR 改动简洁,适合学习如何在 SGLang 中为 XPU 适配混合 Mamba+MoE 模型。重点关注跨平台算子绑定(`elif is_xpu()`)和激活函数白名单扩展的模式。
改进 CPU 图编译自定义 op 注册与显式 fallback 加速
值得精读设计:通过显式 `make_fallback` 规避 Inductor 诊断慢路径的思路可复用于其他算子编译场景。缺少测试配套,建议后续补充 fallback 注册的单元测试。
原始 PR · 作者 arathi-hlab · 合并时间 2026-06-09 09:26
重新启用 XPU CI 的 stage B 测试并拆分测试套件
值得关注 CI 配置模式(预构建镜像拉取 + 多阶段拆分)的实践,可作为其他硬件后端 CI 优化的参考。核心开发人员无需深入阅读代码细节。
原始 PR · 作者 polisettyvarma · 合并时间 2026-06-09 09:22
XPU 启用 fused_experts 量化支持
建议阅读以了解 XPU 支持的扩展方式。后续应补充模型级测试(如 reviewer 提到的 gpt-oss 20B)以验证正确性。
参与讨论