Ascend E2E 测试开启 fully sharded LoRA
该 PR 是 CI 配置调整,不值得精读,但可关注其规避的 vLLM bug 及后续修复,有助于理解 LoRA 分片在异构硬件上的兼容性问题。
标签列表
聚合结果
Ascend E2E 测试开启 fully sharded LoRA
该 PR 是 CI 配置调整,不值得精读,但可关注其规避的 vLLM bug 及后续修复,有助于理解 LoRA 分片在异构硬件上的兼容性问题。
修复 vLLM LoRA 堆叠 QKV 索引错位,改用 unstacked mapper
值得快速精读,重点学习 HollowMan6 提出的最小化 diff 思路:面对上游行为漂移时优先做局部版本分支,而不是复制整段逻辑。建议后续补充一个覆盖 vLLM 0.25/0.26 的 LoRA 权重映射单测,防止这一版本敏感逻辑再次回归。
原始 PR · 作者 HollowMan6 · 合并时间 2026-08-17 10:32
修复 vLLM 权重同步前未恢复权重映射的回归
值得精读。本 PR 展示了同一抽象(sleep_level)在不同推理后端(SGLang / vLLM)下的语义差异,以及框架层如何通过后端分支规避正确性问题。对维护 LoRA 同步链路或计划支持新推理后端的工程师有直接参考价值,改动虽小但蕴含重要的后端适配思维。
修复 LoRA 同步至 SGLang 的七处链式缺陷
值得精读。PR body 是“链式缺陷排查”的范本:逐项回滚的负向对照能区分“确证修复”与“防御修复”,wake_up() 一节如实承认没有证据证明必要但仍保留,实证纪律非常值得借鉴。两个设计原则可以沉淀为团队约定:①让不一致的调用点向已经能工作的那个对齐,而不是发明第三种答案;②对无法表达的配置(正则 target_modules)选择启动时响亮失败,而不是静默适配错误模块集。重点阅读 utils.py 的三个 helper、sglang_rollout.py 的 wrap_lora_params(),以及 http_server_engine.py 的错误 body 日志改造。
原始 PR · 作者 HollowMan6 · 合并时间 2026-08-12 20:43
修复混合 LoRA 模型 .base_layer 权重名解析崩溃
值得精读。它展示了一个典型的“模型级判断”在混合结构下失效的案例,改为“per-name + mapper-aware”的判断是良好的设计取舍。PR body 对两个连续 bug 的根因分析(vLLM 0.26.0 的 loader 递归行为、Bridge 导出前缀与活命名空间差异)质量很高,能帮助理解 verl 的权重同步链路。新增测试精确覆盖了回归场景,可作为类似边界条件的测试范本。
原始 PR · 作者 HollowMan6 · 合并时间 2026-08-10 19:13
修复非合并 LoRA 同步时 vLLM 权重名 .base_layer 解析
值得精读。核心看 `resolve_weight_name` 的分支设计与 vLLM 版本探测逻辑,以及 review 中"非 LoRA 路径性能隔离"和"把解析函数移出扩展类"两条决策;对维护 Megatron + vLLM LoRA 同步链路的工程师尤其重要。建议合入后持续观察不同 vLLM 版本下的回归。
修复 SGLang 在 LoRA merge 模式下仍启用 adapter 的 bug
值得精读。这是一个典型的 bugfix 与设计收敛案例:通过引入单一谓词消除两个后端的行为漂移,并强调两个配置块的不同步问题,对理解 verl 中 LoRA 在 rollout 侧的处理很有帮助。
原始 PR · 作者 ZhiliangWu · 合并时间 2026-08-03 15:34
修复 FSDP 保存 LoRA 模型时错误打包 PeftModel 源码的 bug
值得精读。虽然改动很小,但 PR body 对 transformers custom_object_save 机制和 FSDP1/FSDP2 差异失败模式的分析很有价值;测试设计(stub 分布式原语 + 负向控制验证)也值得借鉴。建议关注 `get_base_model()` 的 peft-only 判断,以及 `save_checkpoint` 中 `auto_map` 分支的容错方式。