2026-08-19
为 CUDA 依赖新增 InstantTensor 包并更新锁文件
该 PR 属于常规依赖维护,值得快速了解,但不建议深入复习。值得关注的是其对未来 InstantTensor 加载器支持的前置意义,可留意后续是否会有相关功能 PR。同时,维护者应确保 InstantTensor 与现有 Torch 版本兼容,并在未来启用加载器时做好充分的测试。
为包式后端恢复 ModelInfo 缓存,修复启动性能回归
值得精读,尤其关注 inspect_model_cls 的路径解析逻辑变更,以及缓存命中对启动性能的影响。设计上回退到 find_spec 是合理的,但需注意对不同模块布局的兼容性。
为 torch.compile 补全平台后端参数,默认仍为 inductor
值得快速浏览的 PR,尤其是平台开发者。改动虽小,但清晰展示了 vLLM 如何通过 `current_platform.simple_compile_backend` 统一管理编译后端。建议关注 `kimi_k25_vit.py` 中 `disable` 与 `backend` 的组合方式,以及后续是否有平台真正覆盖该属性。
为 Stage D 门禁新增 15 个 ROCm mirror,扩展 AMD CI 覆盖
值得精读。这是学习 vLLM 大规模 CI 门禁设计的好样本:mirror 机制如何在保持 NVIDIA 步骤不动的前提下横向扩展硬件覆盖,以及 `source_file_dependencies` 如何精细化控制触发面。重点留意两点:① mamba 个人 fork 引用需要长期跟踪,建议在官方 v2.3.1 验证通过后替换为正式 tag;② 可以将本 PR 的硬件队列规划(MI250/MI300/MI355 的分工)与后续 ROCm CI 演进 PR 对照阅读,理解 Stage D/E 门禁分层的迭代逻辑。
新增 AMD 专属 PR 评论命令,独立映射 Buildkite amd-ci 流水线
值得精读,尤其是 `run_ci_command.py` 中通过 frozenset 分集合 + 映射函数统一控制流的做法,以及为不同 CI 行为差异设计的 `blocks_new_run`、`is_comment_triggered_build` 等函数,对理解多流水线 CI 命令系统的扩展模式有参考价值。建议关注后续是否有将触发条件从手工命令列表改为读取脚本常量的重构机会,以消除重复维护。