#23387 [HiCache][SPEC] fix: empty key after page alignment in match_prefix
原始 PR · 作者 alphabetc1 · 合并时间 2026-04-29 05:06
修复 page 对齐后空 key 索引越界
可直接合并。改动简洁清晰,修复了一个明确的边界条件 bug。建议后续补充针对空 key 或短 key 的单元测试,以防未来重构引入类似问题。
SGLang is a high-performance serving framework for large language models and multimodal models.
原始 PR · 作者 alphabetc1 · 合并时间 2026-04-29 05:06
修复 page 对齐后空 key 索引越界
可直接合并。改动简洁清晰,修复了一个明确的边界条件 bug。建议后续补充针对空 key 或短 key 的单元测试,以防未来重构引入类似问题。
修复 NVFP4 量化导致 Qwen3.5 精度下降
建议精读该 PR 以理解 SGLang 量化打包映射的工作原理。虽然改动简单,但涉及量化精度关键设计,值得关注。
原始 PR · 作者 robellliu-dev · 合并时间 2026-04-29 04:05
修复 multimodal embedding Jinja 模板处理
该 PR 修复了已上报 bug,解决方案稳健,测试全面,建议快速合并。值得关注的设计决策是异常处理策略和 multimodal content 构建顺序,对后续模块有参考价值。
修复 MUSA 设备上 Flash Attention v3 的支持与 API 调用
值得精读,尤其对关注多硬件支持(Moore Threads)的开发者。展示如何将 CUDA 专有函数扩展至其他 GPU 架构,以及关键字参数调用的最佳实践。
为 Gemma4 模型文件添加代码所有者
无需深入阅读。这是一个常规的 CODEOWNERS 维护变更,对理解系统架构无帮助。
原始 PR · 作者 AlonKejzman · 合并时间 2026-04-29 02:43
新增 fastokens tokenizer 后端,加速 TTFT
该 PR 设计清晰,值得精读。关键看点是:①如何通过 monkey-patch 无缝替换 tokenizer 后端;②如何在保证现有路径不变的前提下引入可选高速路径。对于希望了解 SGLang tokenizer 抽象层的开发者来说,这是很好的学习材料。
新增 Nemotron 3 Nano Omni 部署 cookbook
建议合并,同时鼓励 reviewer 验证 snippet 生成的命令是否准确,并检查文档中 API 用例的兼容性。对于希望了解 SGLang 文档架构的开发者,此 PR 是学习 snippet 与 cookbook 协作模式的好例子。
原始 PR · 作者 JustinTong0323 · 合并时间 2026-04-29 01:22
为 MiMo-V2.5 base 启用 EAGLE MTP 文档与代码片段
值得快速阅读。本 PR 展示了如何在文档层面为新变体启用已存在的功能,以及如何修正参数名并同步基准数据。Code Snippet 中的条件移除和逻辑统一是典型的小重构,对入门者理解前端配置驱动的范式有参考价值。另外 review 中关于 benchmark 数据有效性检查的提醒值得团队注意。
参与讨论