Prhub

verl-project/verl

verl: Volcano Engine Reinforcement Learning for LLMs

监控状态:已开启 最近同步:2026-09-01 15:26 同步状态:空闲 下次计划:2026-09-01 16:26
后台正在同步并分析最近 PR,页面会自动刷新并逐步显示最新结果。

PR 列表

更多筛选 · 已设定
✕ 清空
2026-09-01
性能优化 重要性 7.27 洞察度 5.00

FSDP 引擎跳过温度为 1 时的全词表 logits 缩放,降低峰值内存。

建议精读。这是一个小范围但设计精良的性能优化 PR。它清晰地识别了一个可以安全跳过的计算(温度=1 时的恒等缩放),通过引入清晰的辅助函数和状态传递实现了优化,同时配套了完备的测试和容错处理。其“识别并跳过 no-op”的优化思路和“保持兼容性”的实现方式,对于处理类似场景具有参考价值。

重构 重要性 6.61 洞察度 4.00

FSDP-Turbo e2e 测试从 GPU 迁移至 NPU,清理空梯度同步上下文

值得精读,尤其是想了解“如何将一个后端的 e2e 测试从 GPU 迁移到 NPU”以及“如何处置历史 workaround”的读者。关注点:删除 `_gradient_sync_context` 是否真的安全,建议在 PR 描述或后续提交中补充原因;同时留意是否有计划为 GPU 侧补充单元测试或恢复轻量 e2e,避免 fsdp_turbo 在 CUDA 上失去回归保护。

参与讨论