2026-08-31
修复 DP>1 权重同步 drain 的提交竞态超时
值得精读。该 PR 清晰展示了一个异步引擎边界上的竞态:vLLM 的 pause 是“停止调度但接受请求”,verl 必须自行在客户端侧收敛提交。值得关注的设计点包括:单事件循环上“无 await 的检查 + 计数”、barrier 超时降级而非死锁、resume 开门放在 node_rank 守卫之前。建议结合 vllm-project/vllm#51481/#51488 一起阅读,理解上游为何选择 EnginePausedError 语义。
修复禁用 chunked prefill 时 vLLM 启动崩溃并清理旧配置
值得精读。核心价值不在 diff 规模,而在 `_validate_configs` 中如何用“warning + 自动提升”平衡 vLLM 约束与用户显式配置;同时展示了跨示例、CI、测试的连锁清理方法,以及测试在行为不确定性下如何改为观察式断言。建议重点关注 vllm_async_server.py 的安全网分支和 agent-loop 测试的改写思路。
修复 CI 失败:E2E 补 max_model_len 并注释不稳定测试
值得快速浏览,不必精读。建议与 PR#7632 成对阅读,理解 verl 团队应对 vLLM chunked prefill 校验收紧的两层策略;同时留意 vllm.yml 中被注释的 determinism 测试是否有恢复计划。
修复 fully-async 脚本中缺失的 sleep_mode 启用配置,保障 KV 缓存回收功能正常。
此 PR 值得精读,虽然代码改动微小,但它揭示了 vLLM 组件间一个关键的配置依赖关系(sleep mode 对 KV 缓存回收 API 的必要性)。对于维护或扩展 fully-async 功能的开发者尤其重要,需确保所有启动脚本的配置一致。
vLLM 新增 delta_sharded 稀疏权重同步,实测提速约 8 倍
值得精读。这是 delta_sharded 从 SGLang 扩展到 vLLM 的关键一步,对理解 VERL checkpoint 引擎的扩展模式很有价值。重点看:① 坐标映射交由 vLLM 原生 loader 的架构分工(decode_delta_payload + CheckpointWeightPatch);② 失败锁死与“整 session 重建”的运维语义;③ require_vllm_delta_support 的接口探测写法与 _preprocess_engine_kwargs 的拓扑 guard;④ 在无法运行真实路径的 CI 环境里,如何用版本无关回归测试(abort 传播、字节对齐)保护基础设施。