Prhub

sgl-project/sglang

SGLang is a high-performance serving framework for large language models and multimodal models.

监控状态:已开启 最近同步:2026-09-01 17:58 同步状态:空闲 下次计划:2026-09-01 18:58

PR 列表

更多筛选
2026-08-15
缺陷修复 重要性 8.09 洞察度 6.00

修复 diffusion 注意力后端回退过严,区分隐式偏好与显式覆盖

值得精读 selector.py 的“候选回退链”设计:它把严格校验、显式/隐式偏好区分、有界回退与可观测日志组合在一起,对多后端推理框架有普适借鉴意义。建议阅读时重点关注 `selection_is_explicit` 的判定来源和失败时的错误优先级。同时建议后续 PR 将 `is_cross_attention` 贯通到更多 diffusion 模型,并在 AMD/ROCm 上补充端到端验证。

缺陷修复 重要性 3.17 洞察度 2.00

DeepEP wheel 构建修复 /packaging 遮蔽问题

建议快速阅读,作为容器挂载点遮蔽 Python 第三方包的典型修复案例。值得关注的决策:用独立路径规避标准库查找路径的冲突,比在容器内删除或重命名 overlay 更轻量。可留意 DeepEP 发布链路是否值得补充一个检查 packaging.version 可导入的稳态回归测试。

缺陷修复 重要性 3.27 洞察度 3.00

恢复 GLM-4.1V nightly 延迟阈值至校准值 35.5s

值得快速浏览以理解测试阈值治理的教训:一行改动虽小,但背后是“重构移除 guard、恢复时带错旧值”的典型回归链。若要精读,重点看 MODEL_THRESHOLDS 字典的注释约定(1024-token CoT 预算对延迟基线的影响),并思考是否把阈值列表纳入静态 ratchet 防止再次丢失。

#34892 feat: add safeguards for remote media URLs

原始 PR · 作者 mickqian · 合并时间 2026-08-15 18:12

功能 重要性 8.88 洞察度 6.00

新增远程媒体 URL 域名白名单与下载大小限制,防 SSRF

值得精读。核心看点:1) `download_remote_media` 中先用 `requests.Request(...).prepare().url` 统一 URL 规范化再校验,避免解析器分歧绕过;2) 手动逐跳重定向校验 + 流式字节上限 + 全局 deadline 的三重防护设计;3) 在 dummy-model 边界之前通过 server args 发布进程级策略的接线方式。同时注意仓库正处于 server_args → config bag 迁移期,本 PR 在 base_processor/encode_server 新增的直读点应在后续 step 迁移中纳入 bags。

#34825 [diffusion] Bound overlong weight lock filenames

原始 PR · 作者 BBuf · 合并时间 2026-08-15 17:20

缺陷修复 重要性 5.55 洞察度 3.00

限制 diffusion 权重锁文件名长度,避免 ENAMETOOLONG

值得精读。改动虽小,但展示了如何在保持向后兼容的同时处理文件系统边界问题;get_lock 中通过 os.fsencode 以字节尺度判断文件名长度、只对超限路径回退摘要的写法,可作为类似命名约束场景的参考。

基础设施 重要性 4.45 洞察度 3.00

适配 DeepEP v2,更新 CUDA 13 构建依赖

值得发布和镜像维护者精读,理解 DeepEP v2 构建依赖的演化。关注点:条件化 GDRCopy 安装的设计、NCCL 版本锁定方式、以及与 #34923 的边界划分。

功能 重要性 7.26 洞察度 6.00

Kimi-K3 MegaMoE 显式 SiTU 激活并新增 B300 端到端测试

值得精读:1) kimi_k3.py 中从哨兵 hack 到显式 API 的演进;2) mxfp4.py 中多后端权重布局的条件分支设计;3) e2e 测试如何配置 DSPARK + MegaMoE 并设置 SGLANG_OPT_DEEPGEMM_MEGA_MOE_NUM_MAX_TOKENS_PER_RANK。适合想了解 DeepGEMM MegaMoE 集成与 MXFP4 权重准备的工程师。

测试 重要性 5.84 洞察度 6.00

重写 bag 契约测试与 skill 规则,为 step-12 配置重构铺路

值得精读。测试部分展示了如何写出不空洞的契约测试:独立 reference(never-published sibling)、raw-differs guard(只比较 resolution 确实写入且偏离默认值的叶子)、passthrough 与 faithfulness 拆分、CI retry 与进程状态泄漏的交互处理,这套方法论可复用到其他配置/状态系统的契约测试。SKILL.md 的“has published gate 是刻意设计”与“debt means a decision, not automatically a bag read”两处决策也值得留意。建议同时关注未解决的 KT factory 评论在 step-12 落地时的处置,并与 #34094、#34913 联动阅读。

参与讨论