执行摘要
AMD CI 新增 3 个测试注册
作为 NV→AMD CI 覆盖审计的批次 6,将经过验证的、后端无关或 Triton 路径的 CUDA 测试注册到 AMD CI 中,以提升 AMD 平台测试覆盖。PR body 详细说明了已通过和未通过的测试及原因。
该 PR 是纯粹的 CI 配置变更,无源码逻辑改动,适合快速合入。
PR 仅有一条 bot 评论和一条 approve 评论,没有实质性讨论。
作为 NV→AMD CI 覆盖审计的批次 6,将经过验证的、后端无关或 Triton 路径的 CUDA 测试注册到 AMD CI 中,以提升 AMD 平台测试覆盖。PR body 详细说明了已通过和未通过的测试及原因。
该 PR 是纯粹的 CI 配置变更,无源码逻辑改动,适合快速合入。
PR 仅有一条 bot 评论和一条 approve 评论,没有实质性讨论。
from sglang.test.ci.ci_register import register_cuda_ci 修改为 from sglang.test.ci.ci_register import register_amd_ci, register_cuda_ci,以导入 register_amd_ci 函数。register_cuda_ci 调用之后,新增 register_amd_ci 调用,指定预估执行时间和目标套件名称(stage-b-test-1-gpu-large-amd)。test/registered/lora/test_lora_update.py:注册 LoRA 更新测试,AMD 预估时间 730s。test/registered/attention/test_normal_decode_set_metadata.py:注册 decode metadata 测试,AMD 预估时间 17s。test/registered/unit/spec/test_resolve_swa_kv_pool.py:注册 SWA KV 池解析测试,AMD 预估时间 8s。| 文件 | 模块 | 状态 | 重要度 |
|---|---|---|---|
test/registered/lora/test_lora_update.py |
LoRA | modified | 4.28 |
test/registered/attention/test_normal_decode_set_metadata.py |
注意力机制 | modified | 3.52 |
test/registered/unit/spec/test_resolve_swa_kv_pool.py |
KV 缓存 | modified | 3.12 |
test/registered/lora/test_lora_update.py
test-coverage
注册 LoRA 更新测试到 AMD CI,该测试真实运行 Llama-3.1-8B 模型,是 3 个测试中最重要的一个。
# 注册 CUDA CI
register_cuda_ci(
est_time=487,
stage="base-b",
runner_config="1-gpu-large",
)
# 注册 AMD CI
register_amd_ci(
est_time=730, # AMD 预估执行时间,约 CUDA 1.5 倍
suite="stage-b-test-1-gpu-large-amd",
)
作者 @michaelzhang-ai 请求 amd-bot 报告 CI 状态。
结论:amd-bot 回复指出 PR 缺少 `run-ci-extra` 标签导致额外工作流失败,但这些失败不相关,且 AMD 测试尚未在 PR CI 中运行。 · 已解决
风险极低。变更仅限于 CI 注册调用,不修改任何业务逻辑。所有测试已在两条 AMD 流水线上通过,回退成本很小。
对用户和系统无直接影响。对团队而言,AMD CI 覆盖范围扩大,有助于及早发现 AMD 平台上的回归问题。
当前没有检测到明确关联的 Issue 链接,后续同步到相关引用后会出现在这里。
参与讨论