Prhub

sgl-project/sglang

SGLang is a high-performance serving framework for large language models and multimodal models.

监控状态:已开启 最近同步:2026-09-02 20:51 同步状态:空闲 下次计划:2026-09-02 21:51
后台正在同步并分析最近 PR,页面会自动刷新并逐步显示最新结果。

PR 列表

更多筛选
2026-07-14
重构 重要性 9.18 洞察度 6.00

移除废弃的 NVFP4 JIT 内核及 CUTLASS MoE 后端

值得精读,特别是对于关注内核演进和代码清理的读者。展示了如何基于社区替代品逐步淘汰遗留内核,并在过程中处理测试、文档和配置的联动清理。设计决策(如使用早期断言拒绝未使用路径)值得借鉴。

缺陷修复 重要性 5.44 洞察度 4.00

XPU 通过 sgl-kernel 支持 Hadamard 变换

作为 DeepSeek V4 XPU 支持系列的一部分,本 PR 实现简洁,风险低。若需在 XPU 环境运行 DeepSeek-V4,建议合入。注意测试文件未包含在最终变更中(移至 kernel 侧)。

重构 重要性 8.48 洞察度 5.00

迁移 srt/layers 散落内核至 sglang.kernels

作为 Phase 2.5 的重要一环,适合架构组和维护者精读,了解内核迁移的目录约定和注册模板。review 中指出的 missing import 和防御性断言可作为后续 PR 改进的参考。建议在后续 PR 中补充这些断言并修复遗漏的导入。

重构 重要性 9.18 洞察度 7.00

将 ~42 个 MoE Triton 内核从 srt/layers/moe 迁移至 sglang.kernels

值得精读,特别是对内核重构和代码迁移感兴趣的同学。本 PR 展示了大规模代码移动的实践:使用 `git mv` 保留历史、批量更新导入、处理合并冲突。讨论中的自动审查问题提醒我们需要关注原始代码中的缺陷。

#30869 fix: fix Kimi-VL encoder parallelism

原始 PR · 作者 mickqian · 合并时间 2026-07-14 08:44

缺陷修复 重要性 8.91 洞察度 6.00

修复 Kimi-VL 编码器数据并行与 TP 逻辑

该 PR 值得精读,尤其是编码器 DP/TP 集成的模式、CUDA graph 捕获中条件逃逸设计,以及位置推断缓存的 LRU 实现。对于需要支持同类多模态模型的开发者有借鉴意义。

功能 重要性 9.36 洞察度 7.00

集成 Humming 量化内核,提升 MoE 推理性能

值得精读,尤其是 `quantization/humming.py` 的量化方法选择逻辑和 `moe_runner/humming.py` 的 GEMM 类型调度。设计上的权衡(fallback、lazy import、layer 引用传递)对其他后端集成具有参考意义。建议跟进者关注即将到来的测试补充和依赖可选化议题。

参与讨论