Prhub

vllm-project/vllm

A high-throughput and memory-efficient inference and serving engine for LLMs

监控状态:已开启 最近同步:2026-08-21 19:35 同步状态:空闲 下次计划:2026-08-21 20:35

PR 列表

更多筛选
2026-05-05
2026-05-04
测试 重要性 5.29 洞察度 4.00

分离 Nemotron nano-v2/v3 测试,禁用冗余测试

该 PR 虽然只修改了测试配置,但体现了测试策略的微调:将不同变体映射到各自模型以触发差异特性。值得关注的决策点是移除 V2 的 `vision_config` override,未来若出现 OOM 问题可快速恢复。建议 CI 运行后观察 V2 测试是否稳定。

#41620 [Bugfix] Apply ruff-format to hyperclovax.py

原始 PR · 作者 stecasta · 合并时间 2026-05-04 18:37

cleanup 重要性 4.24 洞察度 2.00

修复 hyperclovax.py 格式以通过 ruff-format 检查

作为一次纯粹的格式化修复,此 PR 无需精读。但建议开发者注意:在引入第三方配置(如嵌入 Hugging Face 的配置类)后,应确保代码风格符合项目的格式化标准。

缺陷修复 重要性 4.74 洞察度 4.00

对齐 ROCm 投机解码测试预填设置

建议合并。这是一个低风险、高收益的测试稳定性修复,解决了 ROCm CI 中的间歇性失败。值得关注的是其设计模式——使用共享配置字典确保两个实验组配置一致,可用于其他比较性测试。

缺陷修复 重要性 7.10 洞察度 6.00

自带HCXVisionConfig修复Transformers v5兼容性

推荐阅读。该PR展示了如何通过自带(vendor)上游配置类来修复Transformers v5兼容性问题,并涉及`AutoConfig`注册优先级的协作(关联Transformers PR #45093),对理解vLLM的配置加载机制以及跨仓库兼容性修复有参考价值。

参与讨论