README 新增 verl-vla v0.1.0 发布公告
不值得精读,属常规文档同步操作,快速浏览即可。值得留意的是 verl 生态正以多个独立仓库形式扩展(verl-vla、verl-omni、verl-tinker、rl-insight),README News 区已成为这些发布信息的集中出口,读者可借此理解 verl 的生态战略方向。
verl: Volcano Engine Reinforcement Learning for LLMs
README 新增 verl-vla v0.1.0 发布公告
不值得精读,属常规文档同步操作,快速浏览即可。值得留意的是 verl 生态正以多个独立仓库形式扩展(verl-vla、verl-omni、verl-tinker、rl-insight),README News 区已成为这些发布信息的集中出口,读者可借此理解 verl 的生态战略方向。
原始 PR · 作者 ETOgaosion · 合并时间 2026-08-19 12:59
新增 profiler 收尾钩子,重构 torch 与 rollout 全链路 profiling 采集
值得精读。三个设计决策值得借鉴:① finish hook 采用“每步 relocate + 末尾一次性执行命令”,避免重复上传累积目录;② torch profiler 的 schedule 粒度从 RL step 改为 update mini-batch,并关闭 `ProfilerStep` 行来去噪;③ rollout profiler 的 ranks 按全局 GPU rank 映射到 replica,并在 trace 重定位时过滤 tp 同伴,保证只露出用户请求的 rank。建议同时关注 reviewer 对 rollout profiling 必要性的质疑,评估是否应默认关闭并以 Prometheus 替代。
修复 Qwen3.5 VL 统一检查点构建 Continuous Token 崩溃
值得快速阅读,作为向 _TEXT_TO_VL_FAMILY 扩展新模型家族的参照;测试使用轻量 MockTokenizer / MockProcessor 验证升级路径,思路可复用。但该 PR 改动极小且无深入设计讨论,不建议作为精读案例。
原始 PR · 作者 PeterYang12 · 合并时间 2026-08-19 09:45
ROCm PPO CI 升级镜像并禁用 vLLM custom all-reduce
可以快速阅读本 PR 以了解 ROCm CI 的坑位:核心要点是 vLLM custom all-reduce 在 ROCm 上不可用,以及镜像内依赖应作为唯一事实来源。若后续在 ROCm 上继续开展 CI 优化,建议关注 `disable_custom_all_reduce` 配置在 vLLM 侧的实现,并考虑在更多 ROCm 工作流中复用 `VLLM_ROCM_OVERRIDE` 模式。
原始 PR · 作者 PeterYang12 · 合并时间 2026-08-19 09:41
修复 ROCm 图回放下注意力缓存地址失效问题
值得精读。这个 PR 展示了处理“CUDA graph 持有 buffer 地址”这一经典问题的设计模式:不删除缓存而是原地刷新保持地址稳定,并用 `torch.inference_mode()` 解决推理期 tensor 的可变性约束。对理解量化权重加载、图捕获与动态权重更新之间的交互很有价值。
修复 vLLM LoRA 堆叠 QKV 索引错位,改用 unstacked mapper
值得快速精读,重点学习 HollowMan6 提出的最小化 diff 思路:面对上游行为漂移时优先做局部版本分支,而不是复制整段逻辑。建议后续补充一个覆盖 vLLM 0.25/0.26 的 LoRA 权重映射单测,防止这一版本敏感逻辑再次回归。
原始 PR · 作者 jiefangxuanyan · 合并时间 2026-08-18 12:35
FSDP2 模型传输改非阻塞,H2D 提速约 3.9 倍
值得精读,重点看两点:一是如何在性能优化中处理“依赖未文档化平台行为”的工程姿势——用注释写明约束、用回归测试锁定行为、并严格控制影响面;二是恰当的同步语义文档化,为后续维护者规避异步传输陷阱。对同仓库写 FSDP/rollout 相关代码的开发者,建议在新增模型传输调用前先阅读该 helper 的注释。
Ascend 950 文档更新:kimi checkpoint engine 改白名单支持
可以花少量时间精读这段文档,重点是理解 HCCL 白名单机制在 Ascend 950 上的启用方式;建议在合并后跟进修正 JSON 示例格式,并补充 IP 格式与适用范围说明。若后续有相关源码支持 PR,可与此文档同步更新。
参与讨论