Prhub

verl-project/verl

verl: Volcano Engine Reinforcement Learning for LLMs

监控状态:已开启 最近同步:2026-09-01 17:42 同步状态:空闲 下次计划:2026-09-01 18:42

PR 列表

更多筛选
2026-05-19
功能 重要性 5.88 洞察度 4.00

新增 Qwen3.5-35B Megatron 训练脚本与 checkpoint strict 配置

建议合并此 PR,重点审查 checkpoint strict 默认值(True)是否适合当前 Bridge 版本,以及 NPU 端 expandable_segments 的异常处理是否足够安全。其他配置冗余问题已解决,代码质量可接受。

文档 重要性 3.40 洞察度 3.00

更新 Ascend Docker 构建文档以匹配最新文件

该 PR 为积极响应社区反馈的文档改进,建议合并。未来可考虑自动化脚本验证文档中列出的 Dockerfile 列表与目录实际文件一致,防止再次出现遗漏。

功能 重要性 5.16 洞察度 4.00

新增 Qwen3-30B VeOmni 训练脚本并修复 EP 参数获取 bug

该 PR 值得单读以了解 VeOmni 后端训练脚本的标准结构和 EP 参数修复方式。特别注意 `extra_parallel_sizes` 初始化的一致性问题,建议在其相关 PR (#6346 等) 中确认修复。

2026-05-18
重构 重要性 2.93 洞察度 3.00

将共享 agent skills 从文件符号链接改为目录符号链接

此 PR 解决了技能同步的痛点,设计决策值得关注:目录符号链接与文件符号链接的取舍。建议阅读 `editing-agent-instructions.md` 的更新以了解新约定,并在后续贡献中注意遵循。如果发现任何链接断裂,应及时修复。

缺陷修复 重要性 7.20 洞察度 6.00

重新应用 no-rmpad 蒸馏修复并修复 CPU 测试

值得精读,特别是测试中通过 `patch` 隔离外部依赖(Triton 内核)的做法,这为编写跨平台的单元测试提供了可借鉴的模式。生产修复虽小但正确,体现了对两个分支对称性的重视。

#6388 [doc] refactor: update rocm doc

原始 PR · 作者 mingjielu · 合并时间 2026-05-18 18:10

重构 重要性 5.67 洞察度 4.00

重构 ROCm Dockerfile 并新增快速入门文档

本 PR 适合所有使用 AMD ROCm 的团队精读,特别是 Docker 多阶段构建的实践值得学习。重点关注以下决策: - **拆分存档 vs 统一重构**:保留旧版本文件作为参考,但未对其应用相同改进,这是一种务实的做法,但需确保用户文档明确示意。 - **Review 处理策略**:作者接受部分建议并修复,对设计决策(如 hardcode 版本号)坚持了自身理由,体现了权衡。 建议在合并后补充一个说明,指明 `Dockerfile.rocm6` 为存档,新用户应以 `Dockerfile.rocm` 为准。

参与讨论