Prhub

verl-project/verl · 标签视图

标签列表

聚合结果

lora 相关 PR

2026-08-25
基础设施 重要性 4.26 洞察度 3.00

Ascend E2E 测试开启 fully sharded LoRA

该 PR 是 CI 配置调整,不值得精读,但可关注其规避的 vLLM bug 及后续修复,有助于理解 LoRA 分片在异构硬件上的兼容性问题。

2026-08-19
缺陷修复 重要性 5.41 洞察度 5.00

修复 vLLM LoRA 堆叠 QKV 索引错位,改用 unstacked mapper

值得快速精读,重点学习 HollowMan6 提出的最小化 diff 思路:面对上游行为漂移时优先做局部版本分支,而不是复制整段逻辑。建议后续补充一个覆盖 vLLM 0.25/0.26 的 LoRA 权重映射单测,防止这一版本敏感逻辑再次回归。

2026-08-17
缺陷修复 重要性 6.19 洞察度 4.00

修复 vLLM 权重同步前未恢复权重映射的回归

值得精读。本 PR 展示了同一抽象(sleep_level)在不同推理后端(SGLang / vLLM)下的语义差异,以及框架层如何通过后端分支规避正确性问题。对维护 LoRA 同步链路或计划支持新推理后端的工程师有直接参考价值,改动虽小但蕴含重要的后端适配思维。

2026-08-14

#7413 [sglang] fix: lora sglang e2e

原始 PR · 作者 attack204 · 合并时间 2026-08-14 17:49

缺陷修复 重要性 7.91 洞察度 7.00

修复 LoRA 同步至 SGLang 的七处链式缺陷

值得精读。PR body 是“链式缺陷排查”的范本:逐项回滚的负向对照能区分“确证修复”与“防御修复”,wake_up() 一节如实承认没有证据证明必要但仍保留,实证纪律非常值得借鉴。两个设计原则可以沉淀为团队约定:①让不一致的调用点向已经能工作的那个对齐,而不是发明第三种答案;②对无法表达的配置(正则 target_modules)选择启动时响亮失败,而不是静默适配错误模块集。重点阅读 utils.py 的三个 helper、sglang_rollout.py 的 wrap_lora_params(),以及 http_server_engine.py 的错误 body 日志改造。

2026-08-12
缺陷修复 重要性 6.71 洞察度 6.00

修复混合 LoRA 模型 .base_layer 权重名解析崩溃

值得精读。它展示了一个典型的“模型级判断”在混合结构下失效的案例,改为“per-name + mapper-aware”的判断是良好的设计取舍。PR body 对两个连续 bug 的根因分析(vLLM 0.26.0 的 loader 递归行为、Bridge 导出前缀与活命名空间差异)质量很高,能帮助理解 verl 的权重同步链路。新增测试精确覆盖了回归场景,可作为类似边界条件的测试范本。

2026-08-10
缺陷修复 重要性 8.68 洞察度 6.00

修复非合并 LoRA 同步时 vLLM 权重名 .base_layer 解析

值得精读。核心看 `resolve_weight_name` 的分支设计与 vLLM 版本探测逻辑,以及 review 中"非 LoRA 路径性能隔离"和"把解析函数移出扩展类"两条决策;对维护 Megatron + vLLM LoRA 同步链路的工程师尤其重要。建议合入后持续观察不同 vLLM 版本下的回归。

2026-08-04
缺陷修复 重要性 7.17 洞察度 5.00

修复 SGLang 在 LoRA merge 模式下仍启用 adapter 的 bug

值得精读。这是一个典型的 bugfix 与设计收敛案例:通过引入单一谓词消除两个后端的行为漂移,并强调两个配置块的不同步问题,对理解 verl 中 LoRA 在 rollout 侧的处理很有帮助。

2026-08-03
缺陷修复 重要性 6.51 洞察度 5.00

修复 FSDP 保存 LoRA 模型时错误打包 PeftModel 源码的 bug

值得精读。虽然改动很小,但 PR body 对 transformers custom_object_save 机制和 FSDP1/FSDP2 差异失败模式的分析很有价值;测试设计(stub 分布式原语 + 负向控制验证)也值得借鉴。建议关注 `get_base_model()` 的 peft-only 判断,以及 `save_checkpoint` 中 `auto_map` 分支的容错方式。