Prhub

sgl-project/sglang

SGLang is a high-performance serving framework for large language models and multimodal models.

监控状态:已开启 最近同步:2026-09-03 23:33 同步状态:空闲 下次计划:2026-09-04 00:33

PR 列表

更多筛选
2026-06-17
功能 重要性 7.79 洞察度 6.00

Asymmetric池新增 direct 后端支持,移除 kernel 强制限制

值得精读,特别是 Asymmetric 池的布局和 IO 后端设计,以及 K/V 独立传输的意图。审查者关注如何确保 stride 安全地由单独的 kernel 调用承载。

缺陷修复 重要性 5.57 洞察度 4.00

修复 runner_backend 循环导入导致的 CI 失败

建议所有涉及循环依赖修复的 PR 参考此模式:当符号仅用于类型注解时,利用 `TYPE_CHECKING` 和 `from __future__ import annotations` 延迟导入。此 PR 展示了清晰的诊断和最小化修复,值得精读。

#27589 Unskip Marlin NVFP4 tests

原始 PR · 作者 b8zhong · 合并时间 2026-06-17 02:58

测试 重要性 3.55 洞察度 2.00

取消 Marlin NVFP4 测试的 CI 跳过标记

建议合入。这是一个低风险、高回报的测试恢复变更,能增强 NVFP4 Marlin 后端的 CI 覆盖。未来可考虑将超时测试移到 nightly 以减少 PR 等待时间。

缺陷修复 重要性 5.87 洞察度 4.00

修复--tokenizer-path 缺少 config.json 时 get_processor 失败

该 PR 修复了一个实际问题,代码清晰且讨论中采纳了更好的设计(if-elif 替代 try-except)。值得精读,尤其是 `get_processor` 中的 fallback 模式可作为类似场景的参考。

功能 重要性 9.18 洞察度 7.00

新增LPLB线性规划负载均衡,优化MoE专家路由

这是一个高质量的PR,核心IPM内核设计、空rank处理、性能优化(融合核、预分配、流同步)都值得精读。建议架构师和MoE开发者重点关注,了解如何通过小规模LP优化专家负载分配。

文档 重要性 5.94 洞察度 4.00

GLM-5.2 MTP 调优至 5-1-6 并简化部署参数

值得精读:本 PR 不仅更新了性能数据,更展示了如何通过共享组件条件渲染来简化模型配置。开发者可以学习 `_deployment.jsx` 中根据配置动态选择是否注入环境变量的模式,保持基础组件通用性的同时适应不同模型的需求。

2026-06-16

#28389 [UnifiedTree]: Clean up some unused dead code.

原始 PR · 作者 hzh0425 · 合并时间 2026-06-16 21:53

重构 重要性 6.37 洞察度 2.00

清除 UnifiedTree 中三个未使用的死代码符号

建议快速合并。此类死代码清理有助于保持核心模块的可维护性,且风险经过 CI 验证。

参与讨论