Prhub

verl-project/verl

verl: Volcano Engine Reinforcement Learning for LLMs

监控状态:已开启 最近同步:2026-09-01 18:49 同步状态:空闲 下次计划:2026-09-01 19:49

PR 列表

更多筛选
2026-07-03

#6918 [doc] fix: Update ascend quick_start.rst

原始 PR · 作者 yyyy2000 · 合并时间 2026-07-03 15:17

文档 重要性 2.36 洞察度 2.00

更新 Ascend Quickstart 文档结构与链接

本次 PR 为简单的文档维护,无需深入审查,但可作为文档协作与 review 流程的良好实践示例。

#6831 [ci] chore: add some NPU's UT/ST

原始 PR · 作者 daikang6 · 合并时间 2026-07-03 14:12

基础设施 重要性 6.05 洞察度 4.00

新增 NPU 单元测试/系统测试及 CI 配置

建议合并。该 PR 填补了 NPU 平台测试空白,是基础设施的重要完善。值得关注的设计决策是使用 `get_device_name` 工具函数统一设备抽象,该模式值得在后续测试和核心代码中推广。

2026-07-02
缺陷修复 重要性 8.29 洞察度 6.00

SGLang rollout FP8 忽略层配置集中化并支持正则匹配

值得精读。设计上通过工具函数将多种配置源融合为统一忽略列表,并支持正则匹配以兼容 `llm-compressor` 等工业工具生成的规则。这种模式可以推广到其他推理引擎(如 vLLM)的相似场景。但需注意测试的边界条件(如重叠规则、空字符串、None 等)已被覆盖,可以放心依赖。

性能优化 重要性 7.63 洞察度 7.00

Megatron BSHD 统一 micro-batch 序列长度避免 cuDNN 重复编译

值得精读。该 PR 精准定位了 cuDNN Graph Build 与 micro-batch 填充策略的交互问题,设计简洁有效。建议关注空 batch 安全性的后续修正,并考虑将此类优化扩展至更通用的 THD 路径。

参与讨论