Prhub

#6877 [ci] fix: Add more test cases in e2e_ppo_trainer_megatron_sglang_ascend.yml

原始 PR 作者 xiazhahe 合并时间 2026-06-30 10:22 文件变更 2 提交数 3 评论 1 代码增减 +72 / -1

执行摘要

为 Ascend CI 新增 Qwen3-0.6B 和 GRPO profiling 用例

PR body提到'Fixed some problems of e2e_ppo_trainer_megatron_sglang.yml on Ascend and added more CI cases for maintenance',旨在增加CI测试覆盖以维护代码质量。

该PR是常规CI维护改进,值得关注其新增测试的模式,可用于参考如何添加新的CI测试。

讨论亮点

Gemini Code Assist bot评论指出,移除ref模型的use_flash_attn=True可能导致性能下降或OOM,建议保留并用单加号修正。但该评论未被后续采纳或回复,PR最终被批准合并,说明该配置移除可能是故意的(因双加号Hydra解析问题)或已在其他层面补偿。

实现拆解

  1. CI工作流新增Qwen3测试任务.github/workflows/e2e_ppo_trainer_megatron_sglang_ascend.yml):新增 e2e_ppo_trainer_megatron-qwen3 job,使用Qwen3-0.6B dense模型运行GSM8K E2E测试,验证学习率调度器等特性。
  2. 新增GRPO profiling测试步骤(同一CI文件):在原有DeepSeek模型测试步骤后新增profiling测试,启动GRPO训练并检查profiling文件是否生成。
  3. 修复ref模型flash attention配置tests/special_e2e/run_ppo_trainer_megatron.sh):移除++actor_rollout_ref.ref.megatron.override_transformer_config.use_flash_attn=True行,该处双加号++在Hydra中可能导致解析错误。
文件 模块 状态 重要度
.github/workflows/e2e_ppo_trainer_megatron_sglang_ascend.yml CI modified 5.03
tests/special_e2e/run_ppo_trainer_megatron.sh 测试脚本 modified 3.11

分析完成后,这里会展示 LLM 生成的相对完整源码片段和详细注释。

评论区精华

移除 ref 模型 flash attention 配置 正确性

Gemini Code Assist bot 指出移除 use_flash_attn=True 可能导致性能下降或 OOM,建议用单加号保留。

结论:该评论未被采纳,PR 已被批准合并。可能原因为双加号导致 Hydra 解析冲突,或 flash attention 已在 actor 配置中继承。 · 已解决

风险与影响

  1. 性能风险:移除ref模型flash attention可能导致NPU上推理变慢,但考虑到actor已启用flash attention且ref通常计算量较小,实际影响可能有限。
  2. CI稳定性:新增Qwen3测试和profiling测试可能增加CI运行时间,但提高了覆盖。
  1. CI团队:Ascend E2E CI新增2个测试步骤,覆盖更广泛的模型和特性,有助于早期发现问题。
  2. 开发者:Qwen3模型在Megatron训练上获得持续验证。
  3. 用户:间接受益于更可靠的CI。
CI 配置变更 性能风险(flash attention 移除) 缺少 review 讨论后续

关联 Issue

未识别关联 Issue

当前没有检测到明确关联的 Issue 链接,后续同步到相关引用后会出现在这里。

完整报告

参与讨论