Prhub

sgl-project/sglang

SGLang is a high-performance serving framework for large language models and multimodal models.

监控状态:已开启 最近同步:2026-09-03 00:08 同步状态:空闲 下次计划:2026-09-03 01:08
后台正在同步并分析最近 PR,页面会自动刷新并逐步显示最新结果。

PR 列表

更多筛选
2026-07-28
缺陷修复 重要性 7.24 洞察度 4.00

多模态输入获取/解码失败时返回400而非500

该 PR 是教科书式的错误分类修复,值得精读:通过集中异常元组 `CLIENT_MEDIA_EXCEPTIONS` 实现跨组件错误分类一致性,并通过 mock 测试全面覆盖非功能性路径。设计思路适用于其他需要区分客户端错误和服务端错误的场景。

#32639 docs: clarify diffusion stage reuse guidance

原始 PR · 作者 mickqian · 合并时间 2026-07-28 19:52

文档 重要性 6.02 洞察度 4.00

阐明扩散模型 stage 复用推荐顺序

建议在 diffusion 新模型开发前精读此文档,尤其是 stage 形状选择阶梯;评审者可快速确认贡献者是否遵循了推荐顺序。

缺陷修复 重要性 5.71 洞察度 4.00

修复 diffusion dynamo tracing crash

值得立即合入。该 PR 精准定位了 `@torch.compiler.assume_constant_result` 与 SymInt 不兼容导致的问题,并且采用最小改动修复(增加守卫 + 改用静态 shape)。合入后可解除 `torch.compile` 与 diffusion 模型的兼容性阻塞。

功能 重要性 8.05 洞察度 6.00

新增 cuDNN SDPA 注意力后端及动态回退策略

该 PR 展示了基于 benchmark 驱动的软件设计方法,值得关注。动态回退策略和平台注册模式可复用。建议后续增加自动化测试并定期更新形状阈值。

#31931 [NPU] Optimize DeepSeek-V4 performance

原始 PR · 作者 Talantan1102 · 合并时间 2026-07-28 19:45

性能优化 重要性 9.18 洞察度 6.00

NPU DSV4 PD 分离与性能优化

值得重点阅读的文件:`dsv4_rope.py`(缓存单例设计)、`dsv4_req_to_token_pool.py`(Mixin 抽象)和 `dsv4_common_hooks.py`(PD 适配)。建议关注 `ascend_dsv4_backend.py` 中 graph replay 的元数据刷新逻辑,这是性能关键路径。审查者间关于状态区分和跨文件修改的讨论体现了硬件后端设计中的取舍。

性能优化 重要性 8.06 洞察度 7.00

预分配缓冲消除 Dflash 辅隐藏状态 HBM 尖峰

值得精读:AuxHiddenStatePacker 的设计模式可推广到其他需要累积张量并减少内存峰值的场景。关注 `copies_on_append` 属性的使用和兼容性机制。

#32643 [AMD] Add Kimi K3 ROCm 7.2 nightly image

原始 PR · 作者 yctseng0211 · 合并时间 2026-07-28 18:45

基础设施 重要性 4.70 洞察度 3.00

新增 Kimi K3 ROCm 7.2 每日镜像发布任务

值得关注但无需深入审查。该 PR 是纯 CI 配置变更,逻辑清晰。建议后期确认 `kimi-k3` 分支合并后是否同步更新此 job 的 checkout 分支。

重构 重要性 7.87 洞察度 5.00

删除未使用的 kernel 实现和 registry 条目,清理 4674 行死代码

该 PR 是常规的代码清理工作,不涉及核心逻辑变更,但清理方法值得借鉴:通过全仓库静态分析、AST 对比和 registry 验证来安全删除大量代码。建议关注其 registry 检查机制,未来可推广到其他模块。开发者可精读 `attention/utils.py` 的 re-export 模式和 registry 验证逻辑。

参与讨论